跳到正文

全部动态

今日 42 条
今天10月2日周五
  1. AWS Machine Learning Blog88

    AWS 教程:用 Amazon Bedrock AgentCore Runtime Instances 构建多智能体音乐制作流水线

    AWS 介绍如何在 Amazon Bedrock AgentCore Runtime Instances 上部署由 Composition、Delivery 和 Compliance 三个智能体组成的音乐制作流水线。

    推荐理由:文章用完整的音乐制作示例拆解 Runtime Instances 的部署与编排,展示共享会话、GPU、持久化存储和独立发布如何协同工作。

  2. The Decoder81

    Meta 将 AI 数据中心列为实验项目以节省数十亿美元税款

    据《纽约时报》报道,Meta 将 AI 数据中心归类为“试点模型”、将 Nvidia 芯片视为实验材料,以申请联邦研究税收抵免;公司 2025 年因此节省 $3.9 billion,高于 2024 年的 $2 billion 和 2023 年的 $700 million。

    推荐理由:文章梳理了 Meta 将 AI 数据中心归入研究税收抵免范围的做法及其法律风险,呈现了 AI 基础设施扩张与税务认定之间的张力。

  3. The Decoder79

    Google 在 Gemini 中以 Skills 取代 Gems

    Google 正在向全球 Gemini 聊天用户推出 Skills,以取代 Gems。用户可用“/”加名称调用保存的任务指令,Gemini 还能从历史对话生成 Skills,并在检测到匹配提示词时自动运行。Skills 支持文本文件、PDF 和图像作为参考资料,现有 Gems 会自动转换;Gems 将于 11 月对个人账户停用,并在之后分批停止支持 Workspace 客户。

    推荐理由:Google 将 Gems 迁移为可调用、可组合的 Skills,并公布了资料引用、自动生成和后续协作集成安排。

  4. Ars Technica · AI52

    OpenAI 因 AI 安全担忧推迟 IPO,并寻求筹资 $30 billion 或更多

    OpenAI 已将 IPO 推迟至明年,并正与投资者洽谈新一轮私募融资,目标筹集 $30 billion 或更多,估值约为 $1.4 trillion。公司还计划推出名为 Dots 的 AI 助手;自发布 GPT-5.6 以来,其年化收入增长超过 70%,目前约为 $70 billion。周一,OpenAI 表示因安全担忧取消最新模型的计划发布。

  5. The Verge · AI76

    Google 据报测试向出版商支付 AI 搜索内容费用

    据报道,Google 已启动一项向出版商支付费用的试点计划,约有 100 家出版商参与,其内容对 Search 的 AI Overviews、AI Mode 及 Gemini chatbot 的贡献会影响收入。最早加入的一家出版商一年收入超过 $1 million,几个月前加入的另一家收入约为 $50,000 至 $60,000;该计划面临出版商诉讼和监管机构对网页流量影响的审查。

    推荐理由:报道呈现了 Google 向内容参与 AI 搜索的出版商付费的试点规模与收入差异,也交代了该安排面临的流量和监管压力。

  6. TechCrunch · AI58

    DoorDash 推出可通过 Apple Messages 点餐的 AI 智能体

    DoorDash 推出可通过 Apple Messages 点餐的 AI 智能体,用户可发送“order my usual”、指定菜品或请求本地推荐。智能体会搜索附近商家、建议购物车并发送推荐食物照片,还能处理包含不同饮食偏好和数量的多人订单。该功能面向美国用户开放候补名单,DoorDash 还宣布将在北加州与部分餐厅测试配送无人机。

  7. TechCrunch · AI58

    消费级 AI 的艰难经济学:高成本限制增长,行业转向企业市场

    文章认为,消费级 AI 虽因 Muse、Dots 和 Instinct 等个人智能体受到关注,但消费者付费比例和月均支出增长缓慢,而 AI 运营成本高企。5 月数据显示,2.2%的消费者为 AI 付费,平均每月支出为 $31;作者据此分析,主要实验室正转向企业合同和垂直行业扩张,OpenAI 也在强化企业业务。

  8. TechCrunch · AI79

    Reddit 将关闭 RSS 并终止公共 API 访问以应对 AI 机器人

    Reddit 将于 11 月 13 日停止 RSS 支持,并计划在 2027 年 3 月结束公共 API 访问,理由是大规模抓取和自动化滥用。公共 API 关闭将影响社交监听、研究工具和 AI 产品,相关助手今后需要与 Reddit 达成商业数据协议;获批准的第三方应用和机器人须在 2027 年 1 月 12 日前完成注册。

    推荐理由:文章梳理了 Reddit 关闭 RSS、终止公共 API 及限制 Old Reddit 访问的时间表,也说明这些调整如何影响研究、社交监听和 AI 产品。

  9. TechCrunch · AI55

    语音AI初创公司ElevenLabs估值翻倍至$22B

    语音AI初创公司ElevenLabs宣布以$22B估值向员工提供部分已归属股权的出售机会,较其在2月融资$500 million时的$11B估值翻倍。此次$300 million要约由Wellington和T. Rowe Price联合牵头,是该公司第二次为员工安排二级交易;ElevenLabs此前曾于September 2025以$6.6B估值进行$100 million要约。

  10. TechCrunch · AI62

    Satlyt完成$8M种子轮融资,计划让卫星运行AI并构建轨道云

    Satlyt完成$8M种子轮融资,正在开发让多家公司卫星运行AI模型并共享计算任务的软件。公司此前已将Google DeepMind的Gemma部署到Momentus运营的航天器上,使有关机载软件错误的传输数据量减少60%以上;本周其软件将随TakeMe2Space航天器发射,并计划明年尝试连接两颗卫星形成共享计算系统。

  11. TechCrunch · AI76

    Photon 获得 $4.5M 种子轮融资,押注消息应用中的智能体

    AI 初创公司 Photon 获得 $4.5M 种子轮融资,用于开发通过 iMessage 和 WhatsApp 等消息服务运行智能体的产品。公司称已吸引超过 40,000 名开发者,收入在四个月内增长 10x,消息量上月增长 5x。Photon 提供统一 API、可扩展通道框架、CLI 和可观测性套件,并同时维护开源版本与托管平台。

    推荐理由:Photon 的融资与增长数据,结合其开源和托管两种形态,呈现了消息应用承载智能体的商业化路径。

  12. Hugging Face Blog77

    ServiceNow CoreAI 发布 AutoSynthData,用模型失败生成企业智能体训练数据

    ServiceNow CoreAI 介绍 AutoSynthData,通过目标模型的失败和更强教师模型的成功,生成、验证并迭代企业智能体训练任务。该流程在 EnterpriseOps Gym Hybrid 环境中生成 2,000 个合成样本,使 Gemma-4-26B-A4B-it 的平均 Pass@1 提升 7.2 个百分点,验证器成功率从 63.01% 升至 68.55%。

    推荐理由:文章给出了从模型失败中生成、验证并迭代训练任务的完整流程,并用 EnterpriseOps Gym 实验展示了合成数据对智能体训练的影响。

  13. NVIDIA Blog87

    GPT-6 Astra Ultrafast 借助 NVIDIA Blackwell GPUs 加速生成

    GPT-6 Astra Ultrafast 已通过 OpenAI API 以及符合条件的 ChatGPT Work 和 Codex 用户提供,运行在 NVIDIA Blackwell GPUs 上,token 生成速度最高可达 Astra Standard 模式的 8x。

    推荐理由:文章说明 GPT-6 Astra Ultrafast 如何借助 NVIDIA Blackwell GPUs 提升生成速度,并展示加速对编码智能体工作流的具体作用。

  14. TechCrunch · AI45

    Musk 的 AI 聊天机器人 Grok 据称曾鼓励 Trump 抓捕委内瑞拉总统

    据《时代》报道,Trump 在一次与 Elon Musk 的秘密会面中询问 Grok 如何评价抓捕 Nicolás Maduro,Grok 称 Maduro 是“极不受欢迎的独裁者”,许多委内瑞拉人可能会庆祝其下台。美国入侵委内瑞拉并抓捕 Maduro 后,Trump 据称认为 Grok “极具独创性”。文章还提到,五角大楼曾使用 Gov Grok 部署并打击目标。

  15. Ars Technica · AI69

    美国法官驳回 Chegg 和 Penske 针对 Google AI 搜索的反垄断诉讼

    美国联邦法官驳回 Chegg 和 Penske Media 针对 Google AI 搜索产品的反垄断诉讼,认定 Google 的相关行为不违反反垄断法。Chegg 指控 Google 抓取教育内容供 Gemini 模型重建,Penske 则称网站内容在用于 AI 答案时无法选择退出并造成流量损失;法官认为,网站期待 Google 通过免费内容提供搜索流量,并不构成法律上的协议。

  16. AWS Machine Learning Blog81

    Amazon Quick 推出 Live Data in Apps,让 AI 构建的应用实时查询受治理数据

    Amazon Quick 推出 Live Data in Apps,使 AI 构建的 Quick Apps 能在用户每次打开应用时实时查询受治理的 Quick Sight 数据集,而不再依赖构建时快照。

    推荐理由:文章详细说明了 Live Data in Apps 如何把实时查询、用户级权限和自然语言建应用结合起来,并列出部署时的同意机制与查询限制。

  17. TechCrunch · AI76

    OpenAI 为 ChatGPT 全球推出虚拟试穿和商品收藏功能

    OpenAI 全球推出 ChatGPT 的虚拟试穿和 Favorites 功能,用户可上传自拍、全身照或商品图片,在购物结果中预览服装和配饰效果。新功能使用 ChatGPT Images 2.5,并可将收藏商品与试穿图片保存到应用 Library;用户还可以描述穿搭或上传名人造型图片,让 ChatGPT 寻找可购买的商品。

    推荐理由:文章梳理了 ChatGPT 将虚拟试穿与商品收藏接入购物结果的具体方式,也交代了其与 Google 等既有服务的竞争背景。

  18. TechCrunch · AI59

    OpenAI与三名安全研究人员结束合作,涉机密信息处理违规

    据《华尔街日报》报道,OpenAI因三名安全团队研究人员被指向第三方 AI 安全组织分享机密公司信息,与其结束合作。OpenAI称内部调查确认他们在既定流程之外不当处理敏感信息,但报道未披露研究人员、组织或涉事信息的身份。TechCrunch未确认社交平台流传的相关姓名;此次离职发生在公司近期安全实践争议及GPT-6.1 Astra计划取消之后。

  19. The Decoder70

    Ideogram 4.5 发布,主打图像局部编辑一致性

    Ideogram 表示其新模型 Ideogram 4.5 可在编辑图像局部时尽量保持其他区域不变,面向产品摄影、室内设计、照片修复和图中文字编辑等场景。模型提供 0.8 至 22 cents per image 的四档质量选项,均支持 native 2K resolution,现已在 Ideogram 平台和 API 中提供;官方称开放权重版本即将发布。

  20. AWS Machine Learning Blog67

    AWS 介绍如何用 contextual bandits 优化个性化转化漏斗

    AWS 介绍 Amazon Payments 如何在 Amazon SageMaker AI 上部署多目标 contextual multi-armed bandit,为不同客户选择个性化内容并同时优化申请开始、提交和批准三个阶段。

    推荐理由:文章将多目标 LinUCB、延迟反馈和批处理架构串成可复用方案,并用线上 A/B 测试说明内容池质量会直接限制个性化收益。

  21. TechCrunch · AI80

    Amazon 发布开源决策模型 Strands Decider 2B

    Amazon Web Services 发布开源决策模型 Strands Decider 2B,用于在预设选项中高速选择并提供置信度,定位是比完整 LLM 更适合部分计算机自动化任务。该模型基于 Qwen3.5-2B 构建,体积足够小,可本地运行;Amazon 表示它适合降低智能体工作流步骤的延迟和成本。

    推荐理由:文章梳理了决策模型相对完整 LLM 的定位,并具体说明其在智能体工作流中的低延迟、低成本和置信度优势。

  22. TechCrunch · AI77

    Shopify推出Canvas,商家可通过与AI聊天搭建在线商店

    Shopify推出建站工具Canvas,商家可通过与AI智能体Sidekick聊天创建和修改在线商店。Canvas会实时渲染商店实际代码,支持查看完整交互、动画和不同屏幕尺寸下的页面,并可缩放查看细节。Canvas目前仅支持桌面端,第三方主题、应用区块和扩展、市场、翻译、rollouts及主题更新尚未纳入初始版本。

    推荐理由:Canvas把Sidekick对主题文件的修改与实时渲染结合起来,展示了AI建站从模块编辑转向直接操作实际代码的路径。

  23. AWS Machine Learning Blog82

    AWS 教程:用 Amazon Bedrock AgentCore 构建由事件驱动并支持人工介入的智能体

    AWS 介绍了如何基于 Amazon Bedrock AgentCore 构建 ambient agents,让 Amazon S3 上传和定时事件生成任务,由 AgentCore Runtime 执行,并在需要澄清或审批时通过 ask_human 暂停。

    推荐理由:文章用完整参考实现串起事件触发、AgentCore 执行和人工介入,适合了解如何把智能体接入生产工作流。

  24. AWS Machine Learning Blog74

    Claude Platform on AWS 多环境访问配置指南

    AWS Machine Learning Blog 介绍如何为 Claude Platform on AWS 配置多环境访问,在生产工作负载、开发者笔记本和外部 CI/CD 环境之间共享订阅并隔离工作区。教程分别实现跨账户 SigV4、工作区范围 API key,以及基于 OIDC 的临时凭证和短期 token 访问,并给出 IAM 策略、CLI 命令与 Python 示例。

    推荐理由:文章把 Claude Platform on AWS 的三种访问路径拆成可执行步骤,便于按环境选择认证方式并落实工作区隔离。