跳到正文

全部动态

今日 9 条
今天10月2日周五
  1. The Decoder79

    Google 在 Gemini 中以 Skills 取代 Gems

    Google 正在向全球 Gemini 聊天用户推出 Skills,以取代 Gems。用户可用“/”加名称调用保存的任务指令,Gemini 还能从历史对话生成 Skills,并在检测到匹配提示词时自动运行。Skills 支持文本文件、PDF 和图像作为参考资料,现有 Gems 会自动转换;Gems 将于 11 月对个人账户停用,并在之后分批停止支持 Workspace 客户。

    推荐理由:Google 将 Gems 迁移为可调用、可组合的 Skills,并公布了资料引用、自动生成和后续协作集成安排。

  2. TechCrunch · AI58

    DoorDash 推出可通过 Apple Messages 点餐的 AI 智能体

    DoorDash 推出可通过 Apple Messages 点餐的 AI 智能体,用户可发送“order my usual”、指定菜品或请求本地推荐。智能体会搜索附近商家、建议购物车并发送推荐食物照片,还能处理包含不同饮食偏好和数量的多人订单。该功能面向美国用户开放候补名单,DoorDash 还宣布将在北加州与部分餐厅测试配送无人机。

  3. AWS Machine Learning Blog81

    Amazon Quick 推出 Live Data in Apps,让 AI 构建的应用实时查询受治理数据

    Amazon Quick 推出 Live Data in Apps,使 AI 构建的 Quick Apps 能在用户每次打开应用时实时查询受治理的 Quick Sight 数据集,而不再依赖构建时快照。

    推荐理由:文章详细说明了 Live Data in Apps 如何把实时查询、用户级权限和自然语言建应用结合起来,并列出部署时的同意机制与查询限制。

  4. TechCrunch · AI76

    OpenAI 为 ChatGPT 全球推出虚拟试穿和商品收藏功能

    OpenAI 全球推出 ChatGPT 的虚拟试穿和 Favorites 功能,用户可上传自拍、全身照或商品图片,在购物结果中预览服装和配饰效果。新功能使用 ChatGPT Images 2.5,并可将收藏商品与试穿图片保存到应用 Library;用户还可以描述穿搭或上传名人造型图片,让 ChatGPT 寻找可购买的商品。

    推荐理由:文章梳理了 ChatGPT 将虚拟试穿与商品收藏接入购物结果的具体方式,也交代了其与 Google 等既有服务的竞争背景。

  5. TechCrunch · AI77

    Shopify推出Canvas,商家可通过与AI聊天搭建在线商店

    Shopify推出建站工具Canvas,商家可通过与AI智能体Sidekick聊天创建和修改在线商店。Canvas会实时渲染商店实际代码,支持查看完整交互、动画和不同屏幕尺寸下的页面,并可缩放查看细节。Canvas目前仅支持桌面端,第三方主题、应用区块和扩展、市场、翻译、rollouts及主题更新尚未纳入初始版本。

    推荐理由:Canvas把Sidekick对主题文件的修改与实时渲染结合起来,展示了AI建站从模块编辑转向直接操作实际代码的路径。

10月1日周四
  1. The Verge · AI79

    OpenAI 发布 Dots 智能体,挑战 Meta 的 Muse

    OpenAI 在 DevDay 发布由 GPT-6 Astra 驱动的 Dots 智能体,主打长期任务、知识工作和构建虚拟世界,但目前仅限 $100/月及以上的 ChatGPT Pro 用户使用。

    推荐理由:文章围绕 Dots 与 Muse 的价格、任务范围和隐私取舍展开比较,呈现了 OpenAI 进军智能体市场的产品策略。

  2. The Decoder78

    Anthropic 向美国民用机构开放 Claude for Government

    Anthropic 向美国联邦和州民用机构提供 Claude for Government,该平台自 July 起处于 open beta,并运行在 FedRAMP High 环境中。由于 Pentagon 禁用 Claude,服务目前主要面向民用机构;机构可按使用量付费,管理员能设置预算和模型访问权限,系统提供审计日志及敏感操作的双人审批,聊天内容保留在机构设备上。

    推荐理由:文章梳理了 Claude 面向政府机构开放与 Pentagon 争端的关联,并交代了部署环境、权限管理和数据留存等具体安排。

  3. The Verge · AI24

    Elon Musk 的 Grokipedia 更新设计,推出 v0.3 版本

    Grokipedia 在 v0.3 更新中重新开始加入编辑,并改版标志、首页和实时编辑页面。新版首页新增精选文章、最常读文章及“最新编辑”追踪器,文章页也优化了顶部事实表格和行间距。Grokipedia 此前曾停止更新,SpaceXAI 未立即回应置评请求。

9月30日周三
  1. Google DeepMind86

    Google DeepMind 发布 SynthID Bio,为AI生成蛋白质添加生物水印

    Google DeepMind 发布 SynthID Bio,可将不可见签名嵌入AI生成的蛋白质序列和预测的3D结构,并在合成后的物理蛋白质中验证。实验显示,经过水印处理的蛋白质结合剂在VEGF-A、SARS-CoV-2 spike protein RBD和PD-L1三种目标上保持了与未加水印设计相当的命中率、结合亲和力和自然序列多样性。

    推荐理由:SynthID Bio把水印嵌入蛋白质序列和预测结构,并在实验中保持生物功能,为AI生成生物设计的来源核验提供了具体路径。

  2. NVIDIA Blog81

    NVIDIA 与 CoreWeave 推出 Vera Rubin NVL72、Vera CPU 和 Forge,打通智能体生产闭环

    NVIDIA 与 CoreWeave 宣布在 CoreWeave Cloud 提供 NVIDIA Vera Rubin NVL72,并推出 CoreWeave Forge,用于训练、评估和改进模型与智能体。

    推荐理由:文章串联了 Vera Rubin NVL72、Vera CPU 与 Forge 的发布信息,并给出 Cognition 和 CoreWeave 的测试数据,便于了解智能体从训练到生产的基础设施变化。

  3. Simon Willison58

    Photo Scrubber:本地人脸模糊与元数据移除工具

    Simon Willison 开发了实验性工具 Photo Scrubber,可识别人脸并自动进行模糊处理,以避免分享带有可识别面孔的陌生人照片。该工具使用 Google 的 MediaPipe C++ 库,通过 @mediapipe/tasks-vision 编译为 WebAssembly,并采用 BlazeFace 人脸检测模型;原文还提到 GPT-6 Astra 参与了工具构建。

9月29日周二
  1. AWS Machine Learning Blog64

    Condé Nast 如何用 Amazon Bedrock 构建多模态视频发现系统

    Condé Nast 与 AWS Generative AI Innovation Center 基于 Amazon Bedrock、Amazon OpenSearch Service 和 TwelveLabs Marengo,构建了跨视频画面、音频和字幕的意图检索系统。

    推荐理由:文章以 Condé Nast 的生产案例说明多模态视频检索如何通过解耦架构和异步处理兼顾大规模回填与低延迟搜索。

  2. Microsoft Research84

    Microsoft Research 推出 Quine 生物学 AI 研究系统

    Microsoft Research 推出 Quine,这是一个面向生物学复杂性的多模态世界模型与交互式研究系统,可连接科学工具、文献、湿实验和研究人员。在与 Broad Institute 合作的胰腺癌研究中,Quine 对数千种化合物进行预测和排序,最高排名化合物在多个湿实验中产生了最大的预期细胞状态变化,筛选到候选验证仅用一个周末完成。

    推荐理由:Quine把生物学世界模型与科学工具、文献和实验连接起来,并以胰腺癌细胞状态研究展示了从预测到湿实验验证的工作流程。

9月28日周一
  1. Simon Willison64

    Simon Willison 发布 Bluesky 回复机器人检测工具

    Simon Willison 发布 Bluesky reply bot checker,用于分析账号近期帖文中的打字速度、发布时间、互动模式等行为信号,以检查其是否具有自动回复机器人特征。工具会展示每项测量、判断规则和触发信号最多的示例回复;该工具由 Opus 5.5 通过 vibe coding 编写。

9月25日周五
  1. Google DeepMind83

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,将低延迟流式视频与实时语音对话结合,生成具备唇形同步、表情和连续对话能力的动态视觉化身。该功能支持异步工具调用、97 种语言间切换,并已在 Gemini Enterprise 提供;自定义化身目前仅通过企业 allowlisting 开放,所有输出均带有 SynthID 水印。

    推荐理由:Google DeepMind 展示了 Live Avatar 在实时对话、异步工具调用、多语言同步和品牌定制上的企业应用方式。

9月24日周四
  1. GitHub Blog · AI & ML82

    GitHub Copilot 重构超大 Pull Request 的渲染体验

    GitHub Copilot 重构了 Pull Request 视图,使包含 2,200 个文件、超过一百万行变更和 400 多条行内评论的大型变更仍能流畅打开和滚动。文章介绍了将确定性代码几何与动态评论块分离、按需测量高度、保持滚动锚定,以及通过缓存和后台处理优化数据管线的方法;团队还使用真实运行信号和自动化测试持续定位性能问题。

    推荐理由:文章拆解了 GitHub Copilot 如何处理超大 Pull Request 的虚拟化、动态测量与滚动锚定,为构建高性能代码审查界面提供了可迁移的工程方法。

  2. Microsoft Research79

    Microsoft Research 为 Physical AI Toolchain 增加机器人推理卸载能力

    Microsoft Research 宣布 Physical AI Toolchain 新增面向机器人的物理 AI 推理卸载能力,可将推理部署到机器人、边缘 GPU 或云端。研究显示,卸载推理能够提升移动操作任务的成功率、响应速度和电池续航,并支持运行更大的 AI 模型。该工具集基于 Kubernetes,支持容器化、自动卸载和分布式编排,并提供 SO-101 与 UR10e 的示例项目。

    推荐理由:文章以移动操作任务的测量结果说明推理卸载对成功率、响应、续航和模型规模的影响,并介绍了基于 Kubernetes 的部署工具。

  3. Google DeepMind85

    Google DeepMind 更新 Private AI Compute,支持私有的跨设备持久记忆

    Google DeepMind 发布 Private AI Compute 技术更新,引入服务器端持久记忆,让 AI 可在设备间保留上下文,同时维持端侧隐私标准。用户数据存放在加密存储中,解密密钥仅由个人设备持有,云端通过硬件强制的安全隔离环境临时处理数据。Google DeepMind 还发布更新后的技术白皮书、服务器软件的防篡改公开记录,并提供独立网络安全审计结果。

    推荐理由:文章具体说明了云端持久记忆如何结合设备密钥、加密通道与安全隔离环境,在跨设备连续体验和隐私控制之间取得平衡。

9月23日周三
9月22日周二
  1. NVIDIA Blog80

    NVIDIA Isaac ROS 5.0 推出智能体工作流并支持 ROS Lyrical

    NVIDIA 发布 Isaac ROS 5.0,为基于 ROS 的机器人开发加入智能体工作流,并支持 ROS Lyrical 和 Ubuntu 24.04。新版提供用于设置、操作和 FoundationStereo 微调的技能,以及 agent-ready 文档和 FoundationPose 推理库,后者可将物体位姿感知与跟踪速度提升至 5.5x。

    推荐理由:Isaac ROS 5.0把智能体工作流、ROS Lyrical支持和Jetson部署整合到开源机器人开发中,呈现了从模型适配到实体运行的完整路径。

  2. Hugging Face Blog83

    Hugging Face Transformers 支持运行 llama.cpp GGUF 模型

    Hugging Face 为 transformers 增加 GGUF 模型支持,用户可从 Hub 加载量化 checkpoint,并通过熟悉的 Python、PyTorch 和 transformers API 在 Apple Silicon Mac 上进行本地推理。

    推荐理由:Hugging Face 将 GGUF 与 transformers API 结合,并给出 Apple Silicon 上的安装、调用和基准细节,便于开发者评估本地部署方案。