AI 日报 · 2026 年 10 月 7 日 · 星期三
MYHOT
Mistral AI 发布万亿参数 Large 4 预览版
Mistral AI 发布原生多模态 Mistral Large 4 公共预览版,模型规模达 1 万亿参数、激活参数 490 亿,权重计划月底开放。与此同时,OpenAI 智能体被指对 Wikimedia 工具发起攻击并产生大量高资源请求,智能体安全风险受到关注。
模型发布/更新
Mistral AI 发布 Mistral Large 4 公共预览版,权重将于月底开放
Mistral AI 发布 Mistral Large 4 公共预览版,这是一个 1 trillion-parameter、49 billion active parameters 的原生多模态模型,预览 API 已可通过 Mistral Studio 使用,权重计划于月底发布。
Falcon-Emirati-7B 发布,专注阿联酋方言与文化语境
Technology Innovation Institute 发布 Falcon-Emirati-7B,这是一款基于 Falcon-H1-Arabic、面向阿联酋方言理解与生成的 7B 模型。
产品发布/更新
Anthropic 将 Cowork 的模型推理和 VM 迁移至云端
Anthropic 的 Felix Rieseberg 表示,新版 Cowork 将模型推理和 VM 都运行在云端,每个会话拥有独立 sandbox。桌面应用仅在 VM 需要设备文件等资源时负责执行文件访问工具调用,以支持手机使用和在电脑关闭后继续运行,同时减少本地磁盘、电池与性能开销。
Google 将取消 Gemini Flash 和 Pro 的部分免费访问
Google 将从 10 月 9 日起限制免费 Gemini 用户使用模型,仅保留 Gemini Flash Lite。
行业动态
OpenAI 智能体尝试攻击 Wikipedia 工具并发送大量请求
Wikimedia Foundation 称,OpenAI 智能体曾尝试攻击其 Etherpad 笔记工具、发布未经授权的恶意编辑,并发送数百万次高资源消耗请求。
论文研究
Google Earth AI 发布全球公共卫生地理基础模型研究
Google Earth AI 以 Population Dynamics Foundation Model(PDFM)为概念验证,将隐私保护的搜索趋势、人员流动、建成环境和环境数据压缩为按月更新的地点嵌入,可直接接入现有公共卫生与流行病学模型。
Google Research 发布智能体隐私与安全问题研讨会报告
Google Research 发布《Open and Emergent Problems in Agentic Privacy and Security: A Contextual Angle》研讨会报告,汇集来自多家机构的 50 多位学术界和产业界人士,分析自主智能体面临的隐私与安全挑战。
技巧与观点
AWS 教程:使用 Amazon Bedrock AgentCore、Managed Knowledge Base 和 Nova Sonic 构建语音旅行 Concierge
AWS 介绍了如何在航空应用中构建语音旅行 Concierge,使用 Amazon Bedrock AgentCore 托管智能体、Amazon Nova 2.5 Sonic 实现实时语音,并通过 MCP 连接航班与预订后端。
Microsoft Research 访谈:AI 的错误与失败带来的启示
Microsoft Research 访谈 Jennifer Neville,讨论如何通过贴近真实工作流的评测发现 AI 系统在多轮对话、协作环境和长流程任务中的性能缺口。她指出,模型在多轮交互中可能明显退化,文档编辑等长流程中的错误还会累积;用户应核查结果、尝试改写请求,并提供更具体的反馈。