跳到正文

#Google

今日 0 条
7月30日周四
  1. Google DeepMind75

    Google DeepMind发布Lyria 3.5并上线Google Flow Music

    Google DeepMind发布音乐生成模型Lyria 3.5,并将其上线Google Flow Music。新模型改进了旋律复杂度、歌词质量与提示词遵循、歌声表现和发音,并支持更便捷地控制输出的节奏与时长。

    推荐理由:Lyria 3.5同时更新旋律、歌词、歌声和节奏时长控制,适合了解Google Flow Music的创作能力变化。

7月28日周二
  1. Google DeepMind86

    Google DeepMind 发布 Gemini Robotics 2,提升机器人的全身智能与协作能力

    Google DeepMind 发布 Gemini Robotics 2,包含 Gemini Robotics 2、Gemini Robotics ER 2 和 Gemini Robotics On-Device 2 三个模型,支持人形机器人全身控制、灵巧操作、具身推理和多机器人协作。

    推荐理由:Google DeepMind同时更新了全身控制、灵巧操作、具身推理和端侧适配,呈现了机器人从单步执行走向多步骤协作的技术路径。

7月23日周四
  1. Google Research78

    Google Research 发布 SymptomAI 研究,探索面向日常症状评估的对话式 AI 智能体

    Google Research 介绍 SymptomAI,一组用于日常症状访谈和鉴别诊断的实验性对话式 AI 智能体,并在 n=13,917 的随机研究中与临床专家评估进行比较。

    推荐理由:这项大规模研究把日常症状对话、临床专家评估与 Fitbit 生理信号结合起来,呈现了 SymptomAI 在真实场景中的评估方法与边界。

  2. Google Research83

    Google Research 发表强化学习量子纠错控制研究

    Google Research 在 Nature 发表研究,展示一种利用量子纠错检测事件训练强化学习智能体、在计算持续进行时动态校准控制参数的方法。该方法在 Willow 超导处理器上使逻辑稳定性提高 3.5 倍,并在人工校准后进一步将逻辑错误率降低 20%;数值模拟显示,训练迭代次数与系统规模无关。

    推荐理由:论文展示了强化学习如何利用量子纠错检测事件持续校准控制参数,并用 Willow 实验和大规模模拟检验其稳定性与扩展性。

7月22日周三
7月21日周二
7月17日周五
7月16日周四
  1. Google DeepMind75

    Google DeepMind 与 Isomorphic Labs 发布生物韧性方案

    Google DeepMind 与 Isomorphic Labs 发布联合生物韧性方案,围绕防止模型被滥用、快速检测疫情和设计医疗应对措施展开。过去 12 个月,双方推进了与政府机构、生物安全组织和研究团队的 15 项以上合作,并计划向可信合作伙伴开放 AI 模型和智能体。

    推荐理由:文章系统说明了 Google DeepMind 与 Isomorphic Labs 如何将 AI 用于生物安全,并将防滥用、疫情检测与医疗响应连接起来。

7月13日周一
7月9日周四
  1. Google Research80

    Google Research 发布 SensorFM,探索可穿戴健康数据的通用基础模型

    Google Research 介绍 SensorFM,这一 Large Sensor Foundation Model 在五百万名参与者、超过一万亿分钟的多模态可穿戴传感器数据上预训练。

    推荐理由:文章展示了 SensorFM 如何以大规模无标签可穿戴数据学习通用生理表征,并通过多任务评估和 Personal Health Agent 验证其适配价值。

7月8日周三
  1. Google Research78

    Google Research 通过导航改道实验缓解城市交通拥堵

    Google Research 在10个美国城市开展为期六个月的导航改道实验,通过引导不到2%的出行避开约100个拥堵路段,评估系统性交通改善效果。目标路段车速中位数提高约2%,燃料消耗率中位数下降0.5%至1.0%;受影响路段整体车速中位数提高约0.35%,高峰时段提高0.5%,每个城市每年可能节省数千吨 CO2e。

    推荐理由:研究通过10个美国城市的长期对照实验,量化了少量改道对整体车速、燃耗和排放的系统性影响。

7月3日周五
7月1日周三
  1. Google Research77

    Google Research 发布覆盖50多个城市的 Heat Resilience 屋顶反射率数据与 Earth Engine App

    Google Research 发布覆盖50多个全球城市的建筑级屋顶反射率数据,并上线 Heat Resilience Earth Engine App,帮助城市规划者识别适合部署凉屋顶的建筑和区域。

    推荐理由:Google Research 将建筑级屋顶反射率数据扩展至50多个城市,并开放 Earth Engine App,为城市规划者定位高优先级降温改造提供了可操作的数据基础。

6月30日周二
  1. Google Research82

    Google Research 发布 TabFM 表格数据零样本基础模型

    Google Research 发布 TabFM,一款面向表格数据分类和回归的零样本基础模型,可将训练示例与目标行作为统一上下文,在单次前向计算中生成预测。

    推荐理由:TabFM将表格预测转化为上下文学习任务,并通过合成数据训练与混合注意力架构减少传统建模流程中的调参和特征工程工作。

6月27日周六
6月25日周四
  1. Google Research58

    Google Research 提出线性弹性缓存以优化云成本

    Google Research 提出线性弹性缓存,将页面驱逐建模为滑雪租赁问题,并根据实时工作负载动态调整缓存大小和 TTL。该方法在 Spanner 生产服务器中使内存使用量降低 15.5%,缓存未命中增加 5.5%,总拥有成本降低约 5%,实际 I/O 成本仅增加 0.5%。在公开缓存轨迹上,弹性缓存也持续优于固定大小缓存。

  2. Google Research60

    Google Research 研究推理如何解锁大语言模型中的参数化知识

    Google Research 的论文研究发现,在 Gemini-2.5、Qwen3-32B 等推理模型上,即使面对简单单跳事实问题,生成推理轨迹也能召回关闭推理时难以获得的参数化知识。实验将作用归因于计算缓冲和事实启动,并发现中间推理中的幻觉事实会显著降低最终答案正确率;筛选无幻觉轨迹或通过过程奖励鼓励事实支持的中间步骤可提升准确性。

    推荐理由:研究用受控实验区分了额外计算与事实启动两种机制,并展示中间事实的准确性如何影响最终答案可靠性。

  3. Google DeepMind85

    Google DeepMind 将 computer use 集成至 Gemini 3.5 Flash

    Google DeepMind 宣布 Gemini 3.5 Flash 内置 computer use 工具,可用于构建跨浏览器、移动端和桌面环境执行操作的智能体。开发者和企业可通过 Gemini API 与 Gemini Enterprise Agent Platform 使用该功能,并可启用敏感操作确认和间接提示词注入检测后自动停止等安全措施。

    推荐理由:Gemini 3.5 Flash 将 computer use 纳入内置工具,并配套企业安全措施,展示了构建跨平台智能体时的能力与防护边界。

6月17日周三
  1. Google DeepMind75

    Google DeepMind与英国政府测试AI规划工具,目标将申请处理时间缩短50%

    Google DeepMind与英国政府等合作开发基于Gemini的AI规划原型,目标帮助规划人员将住宅规划申请的决策时间缩短50%。工具可整理历史文件、识别相关政策、总结咨询反馈并起草评估报告,但最终决定仍由规划人员作出;英国政府计划在早期试验后于2027年向全国所有地方政府开放。

    推荐理由:Google DeepMind与英国政府共同测试的原型把规划资料整理、政策核对和报告起草串成一套流程,呈现了AI介入公共服务时的人工复核与审计安排。

  2. Google Research77

    Google 发布用于自然恢复的 Earth AI 矢量数据集

    Google 发布一套面向英国自然恢复的矢量化数据集,可识别并分类树篱、石墙和小片林地等细尺度生态特征。该系统基于 Remote Sensing Foundations 的 ViT Backbone,结合亚米级影像和 1 米 LiDAR 数据,并通过 Polsby–Popper 紧致度评分区分林地、木本斑块和线性木本特征。

    推荐理由:Google 将高分辨率栅格地图转为可操作的矢量数据集,展示了 AI 如何把生态特征识别推进到保护规划与碳核算。

6月16日周二
  1. Google DeepMind84

    Google DeepMind 发布 AI Control Roadmap,构建智能体纵深安全防线

    Google DeepMind 发布 AI Control Roadmap,用纵深防御管理内部 AI 智能体,即使模型对齐不完善,也通过权限控制、威胁建模、监测和阻断降低风险。

    推荐理由:文章系统梳理了 Google DeepMind 的 AI Control Roadmap,展示其如何用监测、阻断和分级响应应对智能体对齐不完善带来的风险。

6月13日周六
  1. Google Research74

    Google Research 研究 AI 如何帮助用户理解皮肤状况

    Google Research 汇总两项关于皮肤状况信息工具的研究,考察图像型 AI 如何帮助用户识别病症并判断后续行动。在一项包含 2,345 名参与者的调查中,AI 辅助下的病症命名准确率为 23%,高于标准搜索的 8%,但标准 AI 对下一步行动准确率没有显著提升。

    推荐理由:两项研究分别从大规模调查和真实社区使用出发,展示了图像型 AI 在识别皮肤状况上的帮助及其在下一步医疗决策上的局限。

6月11日周四
  1. Google Research66

    Google Research 提出机器遗忘审计新框架

    Google Research 提出 Regularized f-Divergence Kernel Tests,用于更灵敏地审计差分隐私和机器遗忘。该框架通过相对三样本检验,判断未学习模型更接近安全重训模型还是原始模型,并在 SVT3 隐私机制中用几千个样本检测违规,而既有方法需要 millions 个样本。

    推荐理由:这项工作把机器遗忘审计从简单的两样本比较转向相对三样本检验,并展示了更少样本和更少调参下识别隐私违规的方法。

6月10日周三
  1. Google DeepMind65

    Google DeepMind 联合伙伴启动最高 $10M 的多智能体 AI 安全研究资助

    Google DeepMind 联合 Schmidt Sciences、Cooperative AI Foundation、ARIA 并获 Google.org 支持,宣布面向全球研究者、最高 $10M 的多智能体 AI 安全研究资助计划。

    推荐理由:这项资助计划把多智能体安全拆分为测试环境、网络行为、基础设施和监督控制四个研究方向,为相关研究提供了明确的问题框架。

6月9日周二
  1. Google DeepMind87

    Google 发布 Gemini 3.5 Live Translate 语音翻译模型

    Google 发布 Gemini 3.5 Live Translate,可自动识别 70+ 种语言并进行接近实时的语音到语音翻译,同时保留说话者的语调、语速和音高。

    推荐理由:Gemini 3.5 Live Translate 将连续语音翻译、音色节奏保留与多端接入结合,文中也列出开发者、企业和普通用户的使用入口。

  2. Google DeepMind86

    Google DeepMind 发布 Gemma 4 12B 多模态模型

    Google DeepMind 发布 Gemma 4 12B,这是一款采用统一、无编码器架构的多模态模型,支持原生音频输入,并面向本地 Agent 工作流。模型性能接近 26B MoE,运行所需内存低于其一半,可在 16GB RAM 或统一内存的笔记本上本地运行。

    推荐理由:Gemma 4 12B把原生音频与视觉输入、Agent 工作流和本地运行结合在一起,材料也给出了部署与开发入口。

6月8日周一
  1. Google DeepMind82

    Google DeepMind 发布塞拉利昂 AI 辅助学习试验结果

    Google DeepMind 发布一项在塞拉利昂开展的预注册试验结果,显示 Guided Learning 组数学成绩较对照组提高 +0.258 个标准差。超过 113,000 次互动分析显示,Gemini 在 76% 的消息中提出支架式问题,仅在 2% 的情况下直接给出答案;教师仍负责设计课程、设定目标和组织讨论。

    推荐理由:这项预注册试验提供了 Guided Learning 介入数学学习的量化结果,也呈现了教师参与和学生提问方式变化。

6月5日周五
  1. Google Research83

    Google Research 发布 PHRM 手机被动心率监测研究

    Google Research 在 Nature 论文中介绍 PHRM,利用手机前置摄像头在面部解锁后采集 8 秒视频,被动估计心率和每日静息心率。该系统在真实环境验证中对心率的 MAPE 为 6.09%,对 Fitbit Charge 6 日静息心率的 MAE 为 4.39 bpm,并发布 PHRM-mini 模型及大型多肤色研究数据集供符合条件的研究人员申请使用。

    推荐理由:研究展示了手机前置摄像头在日常使用中被动估计心率和静息心率的方法,并用多肤色数据验证其准确性与可用范围。

6月4日周四
  1. Google Research80

    Google 开源洪水预报水文建模框架

    Google Research 开源其水文建模框架,供国家气象和水文部门将 AI 洪水预报接入本地工作流。该 Python 包基于 PyTorch,包含 LSTM 模型架构和使用 Caravan 数据集的训练流程,支持加入本地数据训练或微调。

    推荐理由:Google 将洪水预报模型架构、训练流程和文档以 Apache 2.0 许可证开放,研究者与预报机构可结合本地数据训练或微调模型。

5月29日周五
  1. Google Research71

    Google Research 发布 I/O 2026 多领域研究成果

    Google Research 总结 I/O 2026 展示的研究进展,涵盖 Gemini for Science、医疗 AI、WeatherNext、Gemini 核心能力、智能体开发平台和量子计算等方向。

    推荐理由:文章集中呈现 Google Research 在科学发现、医疗、天气预测和智能体开发等方向的研究成果及其产品化路径,便于了解研究如何转化为实际工具。

5月28日周四
  1. Google Research75

    Google 介绍基于零信任聚合的私密分析方案

    Google 介绍了一种用于私密分析的零信任聚合方案,将一次性消息的格基加密协议与 TEE 结合,使设备无需参与多轮交互即可提交数据。该方案确保服务器只能获得匿名聚合结果,并将用于 Android SafetyCore,通过聚合元数据评估端侧安全模型的效果,同时保持用户内容留在设备上。

    推荐理由:文章解释了 Google 如何把一次性加密聚合与 TEE 结合,在降低设备在线要求的同时减少对单一硬件防护的依赖。

5月22日周五
5月20日周三
  1. Google Research91

    Google Research 开放 ERA 科学研究工具并推出 Computational Discovery

    Google Research 开放由 Gemini 驱动的 Empirical Research Assistance(ERA),用于检索文献、编写和优化科学代码,并通过树搜索评估大量实验方案。

    推荐理由:文章同时交代了 ERA 的研究依据、跨学科实验结果和开放路径,可帮助读者理解科学智能体从代码优化走向实际发现工作的方式。

5月19日周二
  1. Google DeepMind74

    Google DeepMind:Co-Scientist 加速发现逆转细胞衰老的遗传因素

    Google DeepMind 介绍了研究人员如何使用 Co-Scientist 研究逆转细胞衰老的遗传因素。Co-Scientist 扫描数万篇论文,提出了 20 多个可测试的遗传因素,其中部分假设经实验验证可使细胞进入更年轻且整体功能改善的状态;它还将筛选数据结合文献的分析工作从最多六个月缩短至几天。

    推荐理由:文章展示了 Co-Scientist 如何从文献中生成可测试的遗传因素,并将筛选数据分析从数月压缩到数天。