AWS 教程:用 Amazon Bedrock AgentCore Runtime Instances 构建多智能体音乐制作流水线
AWS 介绍如何在 Amazon Bedrock AgentCore Runtime Instances 上部署由 Composition、Delivery 和 Compliance 三个智能体组成的音乐制作流水线。
推荐理由:文章用完整的音乐制作示例拆解 Runtime Instances 的部署与编排,展示共享会话、GPU、持久化存储和独立发布如何协同工作。
AWS 介绍如何在 Amazon Bedrock AgentCore Runtime Instances 上部署由 Composition、Delivery 和 Compliance 三个智能体组成的音乐制作流水线。
推荐理由:文章用完整的音乐制作示例拆解 Runtime Instances 的部署与编排,展示共享会话、GPU、持久化存储和独立发布如何协同工作。
Satlyt完成$8M种子轮融资,正在开发让多家公司卫星运行AI模型并共享计算任务的软件。公司此前已将Google DeepMind的Gemma部署到Momentus运营的航天器上,使有关机载软件错误的传输数据量减少60%以上;本周其软件将随TakeMe2Space航天器发射,并计划明年尝试连接两颗卫星形成共享计算系统。
AWS 介绍一种基于 Amazon Bedrock AgentCore 的四智能体架构,用于扩展 300+ 应用的云迁移流程。
推荐理由:文章拆解了四类智能体如何通过 MCP 工具接入迁移流程,并给出 IaC 生成、策略校验和人工审批的实现细节。
AWS 介绍如何将 Amazon S3 Vectors 实现为 NVIDIA NeMo Agent Toolkit 的自定义记忆提供者,并部署在 Amazon EKS 上。
推荐理由:文章把 NAT 自定义记忆插件、S3 Vectors 存储和 EKS 部署串成可执行步骤,适合参考多智能体持久化记忆的工程实现。
AWS 介绍 Amazon Payments 如何在 Amazon SageMaker AI 上部署多目标 contextual multi-armed bandit,为不同客户选择个性化内容并同时优化申请开始、提交和批准三个阶段。
推荐理由:文章将多目标 LinUCB、延迟反馈和批处理架构串成可复用方案,并用线上 A/B 测试说明内容池质量会直接限制个性化收益。
AWS 介绍了如何基于 Amazon Bedrock AgentCore 构建 ambient agents,让 Amazon S3 上传和定时事件生成任务,由 AgentCore Runtime 执行,并在需要澄清或审批时通过 ask_human 暂停。
推荐理由:文章用完整参考实现串起事件触发、AgentCore 执行和人工介入,适合了解如何把智能体接入生产工作流。
AWS Machine Learning Blog 介绍如何为 Claude Platform on AWS 配置多环境访问,在生产工作负载、开发者笔记本和外部 CI/CD 环境之间共享订阅并隔离工作区。教程分别实现跨账户 SigV4、工作区范围 API key,以及基于 OIDC 的临时凭证和短期 token 访问,并给出 IAM 策略、CLI 命令与 Python 示例。
推荐理由:文章把 Claude Platform on AWS 的三种访问路径拆成可执行步骤,便于按环境选择认证方式并落实工作区隔离。
uniopen 使用 Amazon SageMaker AI 对 Amazon Nova 2 Lite 进行基于 LoRA 的监督微调,并通过提示词优化适配其零售内容审核分类。
The Verge 采访 Josh Dzieza,复盘 Kevin O’Leary 在犹他州推动的 Stratos 数据中心项目如何因 40,000-acre 规模、9 gigawatts 用电量、地方居民不知情和强烈反弹陷入诉讼与停滞。
推荐理由:这场调查把一个具体数据中心项目与 AI 基础设施竞速相连,呈现地方审批、社区反弹和融资速度之间的冲突。
NVIDIA宣布,GeForce NOW 将在10月加入25款新游戏,其中6款本周上线,包括《The Witcher 3: Wild Hunt – Remastered》和《Minecraft Dungeons II》。
NVIDIA表示,AI 工厂的投资回报取决于 earning capacity、硬件 useful life 和需求,并以 Productive、Durable、Fungible 三项特性同时优化这三者。
Microsoft Research 开发了一套机器学习管线,为美国本土 66,935 座变电站生成空间天气风险估计,并可提前 30-60 分钟预警具体风险。系统结合太阳风信息、AE 和 Dst 预测、物理约束、当地地质导电率与电网数据,在 2020-2026 年评估期对重大事件的检测率为 76.5%,对严重事件为 81.2%。
推荐理由:文章展示了如何把太阳风预测、地质条件与电网数据串成端到端管线,并用多项检测指标说明其提前预警能力。
NVIDIA 与 CoreWeave 宣布在 CoreWeave Cloud 提供 NVIDIA Vera Rubin NVL72,并推出 CoreWeave Forge,用于训练、评估和改进模型与智能体。
推荐理由:文章串联了 Vera Rubin NVL72、Vera CPU 与 Forge 的发布信息,并给出 Cognition 和 CoreWeave 的测试数据,便于了解智能体从训练到生产的基础设施变化。
Amazon Bedrock 在印度提供 Anthropic Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,并通过印度地理跨区域推理在 ap-south-1 与 ap-south-2 之间路由请求。
Amazon Quick 的提示词工程需按组件调整:Quick Research 应明确研究目标、受众、时间范围和重点,并拆分子问题、筛选数据源;Quick Flows 则要写清时间、触发条件、数据源、输出与交付对象,复杂逻辑用编号步骤表达。通过对话迭代可在保留上下文的基础上修改流程。
AWS 介绍了一套基于 Amazon Quick 和 Amazon Bedrock AgentCore 的合同智能平台,将 PDF 合同抽取为结构化数据并写入 Amazon Aurora PostgreSQL,再通过仪表盘和自然语言查询同时支持组合计和单份合同问答。
推荐理由:文章通过合同场景说明聚合查询为何需要结构化抽取与数据库,并给出双模型校验和确定性服务协同的架构方法。
Condé Nast 与 AWS Generative AI Innovation Center 基于 Amazon Bedrock、Amazon OpenSearch Service 和 TwelveLabs Marengo,构建了跨视频画面、音频和字幕的意图检索系统。
推荐理由:文章以 Condé Nast 的生产案例说明多模态视频检索如何通过解耦架构和异步处理兼顾大规模回填与低延迟搜索。
Mozilla Firefox 负责人 Ajit Varma 表示,Firefox 157 的桌面和移动端改版旨在通过更现代的设计、定制选项和生产力功能吸引更广泛的用户。Firefox 将继续支持 Manifest V2,并提供可关闭或按需启用的 AI 控制,同时加大企业和学校工具投入。Varma 还称,AI 工具帮助 Mozilla 加快开发,但 Gecko、性能和网页兼容性仍是核心投入。
AI 从试验走向生产后,企业不应只比较 token 价格和最新模型,还需评估持续、可预测的工作负载是否适合投资专用算力。是否自建取决于模型、token 结构、性能、能源成本和利用率,企业还要通过采用、治理与扩展高价值用例,让容量持续产生价值。
OpenAI 发布 GPT-6.1 Sol,面向编码、计算机使用和专业工作,智能水平接近 Astra。其 API 输入和输出 token 价格均为 Astra 标准价格的五分之一。
推荐理由:原文将 GPT-6.1 Sol 定位为面向编码、计算机使用和专业工作的模型,并突出其相对 Astra 更低的 API token 价格。
AWS 介绍如何在 SageMaker AI 上使用 AWS vLLM-Omni Deep Learning Container 部署 Qwen3-TTS,通过持久双向连接流式发送文本并接收音频。教程提供仓库、部署脚本和 Gradio 客户端,音频以 24 kHz PCM chunks 返回,并说明 SageMaker 实例池、环境配置、端点调用与资源清理流程。
推荐理由:文章给出从环境配置到资源清理的完整部署路径,并说明双向流式连接与实例池配置,便于复现实时语音输出方案。
Mistral 宣布在慕尼黑开设德国中心,组建 Physics AI 和 Industrial AI 研究团队,并为企业伙伴提供应用工程支持。公司称计划到 2030 年建设 1 gigawatt 的欧洲算力,并依托 open-weight 架构支持客户在自有基础设施上运行模型。
推荐理由:Mistral 将德国据点、Physics AI 研发和本地算力主权结合起来,呈现其切入欧洲工业场景的具体路径。
NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,通过 AlphaFold Database 开放发布覆盖2800多种病毒的预测蛋白复合物3D结构。
推荐理由:文章说明了开放病毒蛋白复合物数据集及生成流程的来源、规模和用途,展示 AI 结构预测如何支持疫情研究准备。
Remedy Entertainment 的《CONTROL Resonant》随发布上线 GeForce NOW,Ultimate 会员可在云端以 GeForce RTX 5080 级性能体验,并支持 NVIDIA DLSS 4、光线追踪、NVIDIA Reflex 和最高 5K HDR。
Microsoft Research 宣布 Physical AI Toolchain 新增面向机器人的物理 AI 推理卸载能力,可将推理部署到机器人、边缘 GPU 或云端。研究显示,卸载推理能够提升移动操作任务的成功率、响应速度和电池续航,并支持运行更大的 AI 模型。该工具集基于 Kubernetes,支持容器化、自动卸载和分布式编排,并提供 SO-101 与 UR10e 的示例项目。
推荐理由:文章以移动操作任务的测量结果说明推理卸载对成功率、响应、续航和模型规模的影响,并介绍了基于 Kubernetes 的部署工具。
Google DeepMind 发布 Private AI Compute 技术更新,引入服务器端持久记忆,让 AI 可在设备间保留上下文,同时维持端侧隐私标准。用户数据存放在加密存储中,解密密钥仅由个人设备持有,云端通过硬件强制的安全隔离环境临时处理数据。Google DeepMind 还发布更新后的技术白皮书、服务器软件的防篡改公开记录,并提供独立网络安全审计结果。
推荐理由:文章具体说明了云端持久记忆如何结合设备密钥、加密通道与安全隔离环境,在跨设备连续体验和隐私控制之间取得平衡。
NVIDIA 验证工程师 Sakeena Fiza 负责在产品量产前验证数据中心系统,排查从单板、机架到集群和生产线的硬件、固件与软件问题。她曾见证 NVIDIA Rubin GPU 首次在系统层面成功枚举,并通过复现故障、改变条件和分析信号,确保系统在客户 AI 工厂中稳定运行。
Simon Willison 发布月度简报 llm-anthropic 0.29,页面显示相关统计为 llm 635、anthropic 343。读者可通过每月 $10 订阅精选的 LLM 动态邮件摘要。
NVIDIA 发布 Isaac ROS 5.0,为基于 ROS 的机器人开发加入智能体工作流,并支持 ROS Lyrical 和 Ubuntu 24.04。新版提供用于设置、操作和 FoundationStereo 微调的技能,以及 agent-ready 文档和 FoundationPose 推理库,后者可将物体位姿感知与跟踪速度提升至 5.5x。
推荐理由:Isaac ROS 5.0把智能体工作流、ROS Lyrical支持和Jetson部署整合到开源机器人开发中,呈现了从模型适配到实体运行的完整路径。
oMLX 创作者兼维护者 Jun Kim 加入 Hugging Face,继续领导该项目并获得稳定维护与资金支持。oMLX 将保持 Apache 2.0 许可,Hugging Face 计划以其作为新想法的测试平台,并推动 transformers 模型定义更快转为可供不同引擎使用的 MLX 实现。
推荐理由:Hugging Face 对 oMLX 的维护支持将 MLX 生态中的个人项目纳入长期投入,并明确了模型定义向 MLX 实现迁移的协作方向。
Hugging Face 为 transformers 增加 GGUF 模型支持,用户可从 Hub 加载量化 checkpoint,并通过熟悉的 Python、PyTorch 和 transformers API 在 Apple Silicon Mac 上进行本地推理。
推荐理由:Hugging Face 将 GGUF 与 transformers API 结合,并给出 Apple Silicon 上的安装、调用和基准细节,便于开发者评估本地部署方案。
NVIDIA 推出 NVIDIA DSX Ready 认证计划,面向符合 NVIDIA DSX AI factory 参考设计要求的合作伙伴产品和解决方案。该计划首批覆盖 BESS 和 CDU,已有 Hitachi Energy、LG Energy Solution、Tesla、LG Electronics、LiquidStack 和 Vertiv 的相关方案获认证。
NVIDIA 表示,埃及 AI 生态正从“潜力”走向生产规模,覆盖开发者、研究人员、初创企业和企业。NVIDIA Deep Learning Institute 在埃及的学习者数量一年增长逾十倍;非洲一年内已有 4 座 AI 工厂宣布或上线,另有 656 megawatts capacity 在建设中。NVIDIA 已在非洲培训超过 85,000 名开发者。
AI 智能体安全需要在模型、工具编排和运行时等每一层设置可执行边界,由明确负责人管理,并用受保护的日志和可重复测试验证防护有效。NVIDIA OpenShell 是开源安全运行时,可在智能体无法干预的范围外执行策略并提供沙箱;Open Secure AI Alliance 合作伙伴正围绕其扩展治理、技能扫描与策略控制。
MIT Technology Review 通过15个月调查,绘制了美国与墨西哥边境监控塔附近死亡事件的综合地图,并分析监控塔是否在相关人员死亡时已部署且可能覆盖现场。调查整合了近4,000起案件、监控塔位置和卫星影像,使用地形分析估算视线是否可能受阻;文章也说明了记录不完整、死亡时间和塔的实际运行状态难以确认等限制。
推荐理由:文章系统拆解了如何整合死亡记录、监控塔位置与卫星影像,并明确说明数据缺口和分析边界,为调查型数据项目提供了可复用的方法参考。
NVIDIA 在纽约气候周聚焦 5 家将 AI 融入清洁能源项目的公司,利用数字孪生、智能体和加速计算推动电网、核能、储能与聚变能源发展。
Hugging Face 发布 tokenizers v1 release candidate,保持与 v0.23 相同的 token IDs、API、词表和 merge ranks,同时重写编码路径以提升性能。
推荐理由:文章用统一基准拆解 tokenizers v1 的性能改动,并给出与 v0.23 的速度和扩展性对比,便于评估升级收益。
Google Research 介绍 MilleMiglia,这是一个用 C++ 编写的中程物流实例生成器,可创建包含固定车辆时刻表、配送中心吞吐限制和复杂同步约束的现实基准数据。它通过空间分布、需求和车辆班次等统计分布生成隐私保护的合成网络,覆盖从小型测试到洲际规模实例,并可用于训练 ML 算法。项目代码和文档已在 GitHub 开源,Google 及学术合作伙伴还在开发专用求解器和 API。
推荐理由:文章解释了中程物流为何难以套用传统 VRP,并展示 MilleMiglia 如何用隐私保护的合成数据支持统一基准与后续求解器研究。
Pawprint Studio 的免费开放世界捉宠 RPG《Aniimo》本周在 GeForce NOW 上线,玩家可跨支持设备云端游玩,无需等待 45GB 下载。007 First Light 新增路径追踪、NVIDIA DLSS 4.5 Ray Reconstruction 等效果;Active Matter、Outer Wilds 等共 11 款游戏加入本周云游戏阵容。
NVIDIA Vera Rubin NVL72 首次提交 MLPerf Inference v6.1 预览结果,在 Qwen3-VL 上的吞吐量最高达到 GB300 NVL72 的 3.7x,在 DeepSeek-R1 上最高达到 2.5x。
推荐理由:文章集中比较 Vera Rubin 与 GB300 在吞吐、跨机架扩展和软件优化上的表现,呈现了影响推理成本的系统级因素。