Google Research 发布 ToolGrad:用文本“梯度”高效生成工具使用数据集
Google Research 在 ACL 2026 介绍 ToolGrad,通过先生成经验证的 API 工具链、再标注对应用户查询的 answer-first 范式生成工具使用数据。
推荐理由:ToolGrad 将工具链生成与用户查询标注拆开,并用文本反馈迭代 API 工作流,为降低工具使用数据的生成成本提供了可复用思路。
Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。
Google Research 在 ACL 2026 介绍 ToolGrad,通过先生成经验证的 API 工具链、再标注对应用户查询的 answer-first 范式生成工具使用数据。
推荐理由:ToolGrad 将工具链生成与用户查询标注拆开,并用文本反馈迭代 API 工作流,为降低工具使用数据的生成成本提供了可复用思路。
Google DeepMind 发布 AlphaGenome Atlas,为人类基因组约 9 billion 个单核苷酸变体预计算分子影响预测,并通过网站、AlphaGenome API 和 Google Antigravity skill 提供访问。
推荐理由:AlphaGenome Atlas 将约 9 billion 个单核苷酸变体的预测整合为可检索资源,并展示了其在罕见病和群体遗传研究中的应用。
Google Research 评估了将 UK Biobank 欧洲人群 GWAS 迁移到 Biobank Japan 日本人群时,PRS 在八种临床性状上的预测表现。
推荐理由:研究系统比较了不同跨人群 GWAS 与 PRS 训练策略,给出了样本规模、性状差异和模型选择之间的实证规律。
Google Research 与 HHMI Janelia及剑桥等机构合作,发布了雄性果蝇大脑和中枢神经系统的完整连接图谱。该图谱包含超过166,000个神经元和1.25亿个突触连接,是按神经元数量计最大的脑图谱,并可通过 Neuroglancer 查看、探索和下载。研究团队使用计算机和 AI 将电子显微镜图像重建为三维神经结构,图谱经过人类专家标注和校验。
推荐理由:这项工作展示了 AI 如何协助构建细胞尺度的完整神经连接图,并提供了可视化、探索和下载的数据资源。
Google DeepMind 和 Google Research 发布 WeatherNext 3 全球天气模型,使用实时卫星数据每小时生成高分辨率预报。模型可在最高 5-kilometer 分辨率下预测天气变量,并提供 100-meter 风速、云量和太阳辐射等清洁能源相关数据。
推荐理由:WeatherNext 3 将实时卫星观测、小时级更新和更高空间分辨率结合起来,并延伸到降水与可再生能源预测。
Google DeepMind 推出 Fairwind Program,向政府、Google Cloud 客户和可信网络安全伙伴限量开放 Gemini 3.8 Flash Cyber 与 CodeMender,用于自主发现、验证和修复漏洞。该项目声称可在组织的安全云环境中于数分钟内生成经过验证、可部署的补丁,并要求参与机构限制内部网络安全团队访问及启用多因素认证。已有超过 650 家合作伙伴参与。
推荐理由:Fairwind Program 将 Gemini 3.8 Flash Cyber 与 CodeMender 结合,展示了受控环境中自动发现、验证并修复漏洞的企业级路径。
Google DeepMind 发布 Gemini 3.8 Flash 和 Gemini 3.8 Flash Cyber,前者面向长程编码、智能体任务与多步推理,后者面向漏洞发现和自动修复。
推荐理由:Gemini 3.8 将通用推理编码与网络安全能力拆分为两个版本,并给出价格、基准和实际使用案例,便于比较其适用场景与成本。
Google Research 与 NASA JPL 合作提出 MAPL-EMIT,用基于 Swin-S Transformer 的深度学习框架分析 NASA EMIT 高光谱数据,自动完成甲烷增强量化、羽流分割和排放源定位。
推荐理由:论文展示了如何用深度学习处理 EMIT 高光谱数据,将甲烷羽流检测、范围分割与源头定位整合到可扩展的全球监测流程中。
Google DeepMind推出Agentic视频理解功能,覆盖Gemini 3.7 Flash、3.6 Flash和3.5 Flash-Lite,可动态搜索视频中的画面、音频和转录内容。
推荐理由:Google DeepMind给出了Agentic视频理解的工作方式、基准变化和接入示例,便于开发者评估长视频分析的成本与实现路径。
Google Research 发布 TimesFM-3,这是一个原生支持多变量预测的时间序列基础模型,拥有 330 million parameters,并在超过 1 trillion 个时间点上预训练。
推荐理由:TimesFM-3把多变量输入、已知未来特征与单次推理结合起来,并在三个公开基准上进行比较,便于了解其适用场景与技术取舍。
Google Research 介绍 Planetary Prediction Engine(PPE),这是 Google Earth AI 旗下的实验性研究能力,可根据自然语言查询自主完成地理数据发现、清理、特征工程、模型训练与评估。
推荐理由:文章展示了 PPE 如何把地理数据发现、特征构建和模型评估串成自动化流程,并用多个领域的基准结果说明其应用价值。
Google DeepMind 推出 Gemini Omni 1.1 Flash,为开发者提供场景延展、首尾帧插值、视频参考和最高4K输出等生成视频能力。模型可分析最多10秒的既有上下文,视频可按10秒增量延展至累计40秒;360p预览生成速度最高提升60%,成本为720p的三分之一。
推荐理由:Gemini Omni 1.1 Flash把场景延展、首尾帧控制、视频参考和4K输出整合进开发接口,呈现了生成视频从原型到制作的具体工作流。
Google DeepMind 宣布试点针对专有前沿级 AI 模型的双盲评测,将外部评测限制在密码学“盒子”中,避免模型提前接触测试内容并据此优化。该项目与 Singapore AI Safety Institute、OpenMined、AVERI 和 MLCommons 合作,在隐私保护环境中使用机密基准测试 Gemini Flash Lite,以降低基准污染对评测完整性的影响。
推荐理由:文章介绍了将外部评测置于密码学环境中的双盲方案,回应了基准污染对模型能力与安全评估可信度的影响。
Google Research 介绍 GlucoFM,一种采用双流设计的自监督连续血糖监测基础模型,用于分离较慢的血糖趋势与短期偏差。模型在四个队列的七项临床预测任务中进行评估,平均 PR-AUC 比同语料预训练的最佳 GluFormer 变体高 5.8 个百分点,并在餐后血糖反应预测中取得最低 MAE。GlucoFM 还展示了跨数据集迁移和少样本适应能力。
推荐理由:文章系统比较了 GlucoFM 在临床预测、餐后血糖预测、跨队列迁移和少样本适应中的表现,并说明双流设计如何利用 CGM 的多时间尺度信号。
Google DeepMind 发布 Gemini 3.5 Transcribe,用于精确的实时语音转写和智能语音交互。模型通过 Gemini API 提供实时流式与预录音频处理两类 API,支持自定义词汇、自动检测和转写超过 85 种语言,以及最多三位说话人的识别。
推荐理由:Gemini 3.5 Transcribe同时覆盖实时流式和预录音频处理,并给出WER、延迟及多语言支持等指标,便于评估其开发适用场景。
Google Research 介绍 Biomarker Discovery Framework,这是一个在人工监督下运行的多智能体系统,用于从可穿戴设备数据中迭代生成、分析和验证候选生物标志物。
推荐理由:文章展示了如何将多智能体协作、确定性统计计算与对抗验证结合,用于在可穿戴传感器数据中筛选候选生物标志物。
Google DeepMind 回顾了从 DQN、AlphaGo、AlphaZero、MuZero 到 AlphaStar 的游戏 AI 研究,并介绍与 Fenris Creations 合作探索 EVE Universe 中的 AI 智能体。
推荐理由:文章梳理了 Google DeepMind 从游戏智能体研究到 EVE Universe 合作的路径,具体呈现了持续学习、记忆和长期规划等研究挑战。
Google Research提出Mobility-Embedded POIs(ME-POIs)框架,将匿名聚合的到达时间、停留时长和周边移动模式与地点文本表示结合,以刻画地点的身份和动态功能。该框架在洛杉矶和休斯顿的未见地点测试中,使访问意图预测相对提升最高81.9%,价格等级分类提升75.1%,繁忙程度估计准确率提升24.7%。
推荐理由:研究将匿名聚合的出行模式融入地点文本表示,并在未见地点的多项属性预测中量化展示了动态空间信息的补充价值。
Google Research 介绍 PhotoScan,一种从标准 2D 手机照片估计体脂率、A/G ratio 和 V/S ratio 的深度学习框架。模型先在 UK Biobank 的 35,323 条记录上预训练,再用 677 名成人的 PhotoBIA 数据微调,并在 132 人的独立队列中验证。
推荐理由:研究用多个独立队列比较 PhotoScan 与 BIA、DXA 在体成分估计和胰岛素抵抗分类上的表现,展示了手机影像的研究价值。
Google DeepMind 发布 Gemini 3.7 Flash,称其在编码、知识工作和网页开发工作流上较 Gemini 3.6 Flash 有明显提升。
推荐理由:Gemini 3.7 Flash给出了多项编码、文档处理和工作流基准对比,并同步公布了API价格,便于评估其生产环境价值。