AWS 教程:用 Amazon Bedrock AgentCore Runtime Instances 构建多智能体音乐制作流水线
AWS 介绍如何在 Amazon Bedrock AgentCore Runtime Instances 上部署由 Composition、Delivery 和 Compliance 三个智能体组成的音乐制作流水线。
推荐理由:文章用完整的音乐制作示例拆解 Runtime Instances 的部署与编排,展示共享会话、GPU、持久化存储和独立发布如何协同工作。
AWS 介绍如何在 Amazon Bedrock AgentCore Runtime Instances 上部署由 Composition、Delivery 和 Compliance 三个智能体组成的音乐制作流水线。
推荐理由:文章用完整的音乐制作示例拆解 Runtime Instances 的部署与编排,展示共享会话、GPU、持久化存储和独立发布如何协同工作。
AWS 介绍了如何使用 Amazon Bedrock Knowledge Bases 和 AgenticRetrieveStream,基于 Amazon S3 中的理赔文档构建带引用的自然语言查询助手。
推荐理由:文章以合成保险理赔数据演示如何结合 AgenticRetrieveStream、元数据过滤和上下文接地检查,构建带引用的 RAG 查询流程。
据《纽约时报》报道,Meta 将 AI 数据中心归类为“试点模型”、将 Nvidia 芯片视为实验材料,以申请联邦研究税收抵免;公司 2025 年因此节省 $3.9 billion,高于 2024 年的 $2 billion 和 2023 年的 $700 million。
推荐理由:文章梳理了 Meta 将 AI 数据中心归入研究税收抵免范围的做法及其法律风险,呈现了 AI 基础设施扩张与税务认定之间的张力。
Google 正在向全球 Gemini 聊天用户推出 Skills,以取代 Gems。用户可用“/”加名称调用保存的任务指令,Gemini 还能从历史对话生成 Skills,并在检测到匹配提示词时自动运行。Skills 支持文本文件、PDF 和图像作为参考资料,现有 Gems 会自动转换;Gems 将于 11 月对个人账户停用,并在之后分批停止支持 Workspace 客户。
推荐理由:Google 将 Gems 迁移为可调用、可组合的 Skills,并公布了资料引用、自动生成和后续协作集成安排。
OpenAI 已将 IPO 推迟至明年,并正与投资者洽谈新一轮私募融资,目标筹集 $30 billion 或更多,估值约为 $1.4 trillion。公司还计划推出名为 Dots 的 AI 助手;自发布 GPT-5.6 以来,其年化收入增长超过 70%,目前约为 $70 billion。周一,OpenAI 表示因安全担忧取消最新模型的计划发布。
据报道,Google 已启动一项向出版商支付费用的试点计划,约有 100 家出版商参与,其内容对 Search 的 AI Overviews、AI Mode 及 Gemini chatbot 的贡献会影响收入。最早加入的一家出版商一年收入超过 $1 million,几个月前加入的另一家收入约为 $50,000 至 $60,000;该计划面临出版商诉讼和监管机构对网页流量影响的审查。
推荐理由:报道呈现了 Google 向内容参与 AI 搜索的出版商付费的试点规模与收入差异,也交代了该安排面临的流量和监管压力。
Meta 推出 Muse AI 智能体,声称可处理发送邮件、在线购物等任务,但用户需将数据和信用卡交给 Meta。Meta 还宣布推出类似 Tamagotchi 的 Muse Charm,并持续扩展 Muse 的企业、文件系统、视频聊天、智能眼镜和 Mac app 能力;该智能体曾因漏洞被攻击者控制。
DoorDash 推出可通过 Apple Messages 点餐的 AI 智能体,用户可发送“order my usual”、指定菜品或请求本地推荐。智能体会搜索附近商家、建议购物车并发送推荐食物照片,还能处理包含不同饮食偏好和数量的多人订单。该功能面向美国用户开放候补名单,DoorDash 还宣布将在北加州与部分餐厅测试配送无人机。
Meta 否认 AI 智能体 Muse 在未获许可的情况下读取用户 Mac 私信,称用户必须分别启用 Full Disk Access 和 Messages connector。
文章认为,消费级 AI 虽因 Muse、Dots 和 Instinct 等个人智能体受到关注,但消费者付费比例和月均支出增长缓慢,而 AI 运营成本高企。5 月数据显示,2.2%的消费者为 AI 付费,平均每月支出为 $31;作者据此分析,主要实验室正转向企业合同和垂直行业扩张,OpenAI 也在强化企业业务。
Reddit 将于 11 月 13 日停止 RSS 支持,并计划在 2027 年 3 月结束公共 API 访问,理由是大规模抓取和自动化滥用。公共 API 关闭将影响社交监听、研究工具和 AI 产品,相关助手今后需要与 Reddit 达成商业数据协议;获批准的第三方应用和机器人须在 2027 年 1 月 12 日前完成注册。
推荐理由:文章梳理了 Reddit 关闭 RSS、终止公共 API 及限制 Old Reddit 访问的时间表,也说明这些调整如何影响研究、社交监听和 AI 产品。
语音AI初创公司ElevenLabs宣布以$22B估值向员工提供部分已归属股权的出售机会,较其在2月融资$500 million时的$11B估值翻倍。此次$300 million要约由Wellington和T. Rowe Price联合牵头,是该公司第二次为员工安排二级交易;ElevenLabs此前曾于September 2025以$6.6B估值进行$100 million要约。
OpenAI 在 Dev Day 活动中披露了 Decisions API,可让 Luna 在预设选项中快速选择,用于图像分类或智能体行为判断。该 API 目前仅限预览,文章将其与 TypeSafe AI 的 Jev 比较,并以 Jev 监控智能体行为的案例说明这类模型可能降低审查成本。
AI 硬件设计初创公司 Flow Engineering 宣布完成 $50 million B 轮融资,估值达 $750 million,Valor Equity Partners 与 Atreides Management 联合领投,Sequoia Capital 等跟投。
Google 母公司 Alphabet 发布 Gemini 4 Argon,面向编码、研究和写作等任务,重点用于防御性网络安全。该模型目前通过 Fairwind Program 向部分网络安全合作伙伴开放,Google 称其能够自主发现、验证并修复关键软件漏洞。
Satlyt完成$8M种子轮融资,正在开发让多家公司卫星运行AI模型并共享计算任务的软件。公司此前已将Google DeepMind的Gemma部署到Momentus运营的航天器上,使有关机载软件错误的传输数据量减少60%以上;本周其软件将随TakeMe2Space航天器发射,并计划明年尝试连接两颗卫星形成共享计算系统。
听力科技初创公司 Legato 发布可购买的 AI 助听眼镜 Legato Frames,起售价为 $999,面向轻度至中度听力损失的成年人。眼镜通过 AI 区分人声与背景噪音,在设备端完成处理,不使用摄像头或录音;产品重 34 克,续航 10-12 小时,并支持处方镜片和 Bluetooth 音频串流。
AI 初创公司 Photon 获得 $4.5M 种子轮融资,用于开发通过 iMessage 和 WhatsApp 等消息服务运行智能体的产品。公司称已吸引超过 40,000 名开发者,收入在四个月内增长 10x,消息量上月增长 5x。Photon 提供统一 API、可扩展通道框架、CLI 和可观测性套件,并同时维护开源版本与托管平台。
推荐理由:Photon 的融资与增长数据,结合其开源和托管两种形态,呈现了消息应用承载智能体的商业化路径。
ServiceNow CoreAI 介绍 AutoSynthData,通过目标模型的失败和更强教师模型的成功,生成、验证并迭代企业智能体训练任务。该流程在 EnterpriseOps Gym Hybrid 环境中生成 2,000 个合成样本,使 Gemma-4-26B-A4B-it 的平均 Pass@1 提升 7.2 个百分点,验证器成功率从 63.01% 升至 68.55%。
推荐理由:文章给出了从模型失败中生成、验证并迭代训练任务的完整流程,并用 EnterpriseOps Gym 实验展示了合成数据对智能体训练的影响。
Latent Space 访谈 MIT 的 Alex Zhang,讨论 GPU kernel、RLM 和智能体 harness 如何扩展语言模型系统的能力。Alex Zhang 解释了 RLM 的上下文卸载、代码执行、递归子智能体与共享内存,并提出 harness 设计可能提升跨任务的组合泛化。
GPT-6 Astra Ultrafast 已通过 OpenAI API 以及符合条件的 ChatGPT Work 和 Codex 用户提供,运行在 NVIDIA Blackwell GPUs 上,token 生成速度最高可达 Astra Standard 模式的 8x。
推荐理由:文章说明 GPT-6 Astra Ultrafast 如何借助 NVIDIA Blackwell GPUs 提升生成速度,并展示加速对编码智能体工作流的具体作用。
AWS 介绍一种基于 Amazon Bedrock AgentCore 的四智能体架构,用于扩展 300+ 应用的云迁移流程。
推荐理由:文章拆解了四类智能体如何通过 MCP 工具接入迁移流程,并给出 IaC 生成、策略校验和人工审批的实现细节。
据《时代》报道,Trump 在一次与 Elon Musk 的秘密会面中询问 Grok 如何评价抓捕 Nicolás Maduro,Grok 称 Maduro 是“极不受欢迎的独裁者”,许多委内瑞拉人可能会庆祝其下台。美国入侵委内瑞拉并抓捕 Maduro 后,Trump 据称认为 Grok “极具独创性”。文章还提到,五角大楼曾使用 Gov Grok 部署并打击目标。
美国联邦法官驳回 Chegg 和 Penske Media 针对 Google AI 搜索产品的反垄断诉讼,认定 Google 的相关行为不违反反垄断法。Chegg 指控 Google 抓取教育内容供 Gemini 模型重建,Penske 则称网站内容在用于 AI 答案时无法选择退出并造成流量损失;法官认为,网站期待 Google 通过免费内容提供搜索流量,并不构成法律上的协议。
Amazon Quick 推出 Live Data in Apps,使 AI 构建的 Quick Apps 能在用户每次打开应用时实时查询受治理的 Quick Sight 数据集,而不再依赖构建时快照。
推荐理由:文章详细说明了 Live Data in Apps 如何把实时查询、用户级权限和自然语言建应用结合起来,并列出部署时的同意机制与查询限制。
Google 在兼容的 Android 设备上的 Gemini Live 推出 Guided Vision,为摄像头拍摄的内容提供实时音频描述。它可帮助用户阅读小字、描述环境、查找或识别物体,并支持在 Gemini 应用和 Google TalkBack 中使用;Android 9 及以上设备还可通过设置添加辅助功能快捷方式。
OpenAI 全球推出 ChatGPT 的虚拟试穿和 Favorites 功能,用户可上传自拍、全身照或商品图片,在购物结果中预览服装和配饰效果。新功能使用 ChatGPT Images 2.5,并可将收藏商品与试穿图片保存到应用 Library;用户还可以描述穿搭或上传名人造型图片,让 ChatGPT 寻找可购买的商品。
推荐理由:文章梳理了 ChatGPT 将虚拟试穿与商品收藏接入购物结果的具体方式,也交代了其与 Google 等既有服务的竞争背景。
Google 的轨道计算卫星搭载 SpaceX 火箭升空,首次将其 TPU 芯片送入太空,以测试供电、散热、模型推理和辐射环境下的运行表现。
推荐理由:文章把 Google 的轨道计算设想与 Starship 的发射规模要求放在同一框架中,呈现了太空数据中心面临的工程与成本约束。
据《华尔街日报》报道,OpenAI因三名安全团队研究人员被指向第三方 AI 安全组织分享机密公司信息,与其结束合作。OpenAI称内部调查确认他们在既定流程之外不当处理敏感信息,但报道未披露研究人员、组织或涉事信息的身份。TechCrunch未确认社交平台流传的相关姓名;此次离职发生在公司近期安全实践争议及GPT-6.1 Astra计划取消之后。
Tavus 推出 Griffin,这是一种用于实时面对面视频对话的 Human Interaction Model。Tavus 的研究显示,48%的参与者在一分钟视频通话后认为 Griffin 是真人;在一项 Nvidia 测试中,Griffin 得分为 3.83,真人为 3.92,上一代最佳 AI 模型为 2.80。
Graphite 研究比较了人类文章与 Claude Opus 5.5、OpenAI Astra、Gemini 3.1 Pro 等模型生成文本,发现 AI 写作仍存在大量特征性词组和句式。Opus 5.5 使用“this matters”的频率是人类文本的 116 倍,“dependable”则高出 23 倍;模型虽然大幅减少了破折号使用,但新的写作特征仍会出现。
AWS 介绍如何将 Amazon S3 Vectors 实现为 NVIDIA NeMo Agent Toolkit 的自定义记忆提供者,并部署在 Amazon EKS 上。
推荐理由:文章把 NAT 自定义记忆插件、S3 Vectors 存储和 EKS 部署串成可执行步骤,适合参考多智能体持久化记忆的工程实现。
Ideogram 表示其新模型 Ideogram 4.5 可在编辑图像局部时尽量保持其他区域不变,面向产品摄影、室内设计、照片修复和图中文字编辑等场景。模型提供 0.8 至 22 cents per image 的四档质量选项,均支持 native 2K resolution,现已在 Ideogram 平台和 API 中提供;官方称开放权重版本即将发布。
美国联邦法官驳回 Chegg 和 Penske Media Corporation 针对 Google AI 搜索功能的反垄断诉讼,认为两家公司关于 Google 以免费内容换取搜索曝光并分流网站流量的主张不符合反垄断法。
高级 AI 可能最重要的作用,是承担突破性想法背后的常规工作,从而让执行能力影响下一阶段经济发展与进步速度。
AWS 介绍 Amazon Payments 如何在 Amazon SageMaker AI 上部署多目标 contextual multi-armed bandit,为不同客户选择个性化内容并同时优化申请开始、提交和批准三个阶段。
推荐理由:文章将多目标 LinUCB、延迟反馈和批处理架构串成可复用方案,并用线上 A/B 测试说明内容池质量会直接限制个性化收益。
Amazon Web Services 发布开源决策模型 Strands Decider 2B,用于在预设选项中高速选择并提供置信度,定位是比完整 LLM 更适合部分计算机自动化任务。该模型基于 Qwen3.5-2B 构建,体积足够小,可本地运行;Amazon 表示它适合降低智能体工作流步骤的延迟和成本。
推荐理由:文章梳理了决策模型相对完整 LLM 的定位,并具体说明其在智能体工作流中的低延迟、低成本和置信度优势。
Shopify推出建站工具Canvas,商家可通过与AI智能体Sidekick聊天创建和修改在线商店。Canvas会实时渲染商店实际代码,支持查看完整交互、动画和不同屏幕尺寸下的页面,并可缩放查看细节。Canvas目前仅支持桌面端,第三方主题、应用区块和扩展、市场、翻译、rollouts及主题更新尚未纳入初始版本。
推荐理由:Canvas把Sidekick对主题文件的修改与实时渲染结合起来,展示了AI建站从模块编辑转向直接操作实际代码的路径。
AWS 介绍了如何基于 Amazon Bedrock AgentCore 构建 ambient agents,让 Amazon S3 上传和定时事件生成任务,由 AgentCore Runtime 执行,并在需要澄清或审批时通过 ask_human 暂停。
推荐理由:文章用完整参考实现串起事件触发、AgentCore 执行和人工介入,适合了解如何把智能体接入生产工作流。
AWS Machine Learning Blog 介绍如何为 Claude Platform on AWS 配置多环境访问,在生产工作负载、开发者笔记本和外部 CI/CD 环境之间共享订阅并隔离工作区。教程分别实现跨账户 SigV4、工作区范围 API key,以及基于 OIDC 的临时凭证和短期 token 访问,并给出 IAM 策略、CLI 命令与 Python 示例。
推荐理由:文章把 Claude Platform on AWS 的三种访问路径拆成可执行步骤,便于按环境选择认证方式并落实工作区隔离。