AI 日报 · 2026 年 10 月 6 日 · 星期二
MYHOT
GitHub 发布 AI 代码审查开放基准 ReviewBench
GitHub 发布 ReviewBench,基于 1.039 亿个 GitHub pull request 的分布构建,收录 219 个 pull request,覆盖 19 种语言,用于离线评测 AI 代码审查 Agent。与此同时,Reka AI 发布全模态模型 Rho-1,统一处理文本、图像、视频与机器人控制。
模型发布/更新
Reka AI发布Rho-1全模态模型,统一处理文本、图像、视频与机器人控制
Reka AI发布Rho-1研究预览版,这个190亿参数的全模态模型可在单一神经网络中处理并生成文本、图像、视频和机器人控制动作。Rho-1将所有模态作为token放入共享上下文窗口,无需工具调用或外部模型,并可实时生成连续视频、根据新指令调整动作。为缓解机器人训练数据稀缺,Reka AI从普通互联网视频中提取控制信号;模型使用320块H100 GPU训练约三个月。
产品发布/更新
Amazon Quick 如何通过 MCP 实现可审计的跨账号资源迁移
AWS 介绍了 Quick Resource Migrator,通过部署在 Amazon Bedrock AgentCore 上的 MCP server,将 Amazon Quick 的 agents、action connectors、knowledge bases、flows 和 spaces 从开发账号迁移到目标账号。
TikTok推出AI购物助手和一键结账功能
TikTok推出AI购物助手和应用内结账功能,用户可在For You feed中直接向品牌一键购买。购物助手是能理解上下文并记住用户偏好的对话式AI智能体,可提供产品详情、配送、尺码、库存和购买协助。新功能与Salesforce、Shopify、Shoplazza和Stripe等商务平台及支付服务商合作开发。
OpenAI 将在 ChatGPT 和 Codex 中加入文本水印
OpenAI 将在欧盟逐步为 ChatGPT 和 Codex 各计划用户推出不可见、机器可读的 textGrain 文本水印,首发时不会设为全球默认。全球 API 客户可从今天起为部分模型输出选择启用水印,获批研究人员和专家组织也可申请检测器访问;OpenAI 表示该水印不保证可靠检测,也不能证明文本准确、归属、人类贡献程度或人类作者身份。
HackerRank 向客户开放 AI 面试官 Chakra
HackerRank 将 AI 智能体面试官 Chakra 向客户开放,用于在真实代码仓库任务中观察候选人的工作过程,并评估答案、批判性思维、判断力和 AI fluency。Chakra 在测试期间已完成超过 500,000 次面试,企业可获得详细报告,但最终招聘决定仍由人类作出。文章还提到,自动化招聘工具面临偏见风险及监管审查。
AWS 发布 aws-ai-ml skill,为编码智能体提供 SageMaker 生成式 AI 推理优化能力
AWS 在 Agent Toolkit for AWS 中推出 aws-ai-ml skill,可让 Kiro、Claude Code、Codex 等支持 MCP 的编码智能体执行 SageMaker AI 端点基准测试、实例配置推荐、基准对比,并生成可运行的 SageMaker Python SDK v3 代码。
论文研究
GitHub 发布 ReviewBench:面向 AI 代码审查的开放基准
GitHub 发布 ReviewBench,这是一个面向 AI 代码审查 Agent 的开放离线基准,基于 103.9M 个 GitHub pull request 的分布构建了包含 219 个 pull request、覆盖 19 种语言的评测集。
技巧与观点
AWS 详解如何在 GovCloud 中用 Claude Code 和 Amazon Bedrock 支持受监管工作负载
AWS 介绍了如何在 AWS GovCloud(US)中通过 Amazon Bedrock 使用 Claude Code,为受监管工作负载配置 AI 辅助开发。
LangChain 如何在 Amazon Bedrock Knowledge Bases 中实现智能体检索
AWS 介绍了如何结合 LangChain 与 Amazon Bedrock Managed Knowledge Bases 构建智能体检索 RAG 应用。文章对比 Retrieve API 的单次检索与 AgenticRetrieveStream 的规划循环,展示后者如何拆分子查询、评估证据并按需继续搜索。