Alex Zhang 谈 RLM、GPU kernel 与智能体 harness 的研究方向
Latent Space 访谈 MIT 的 Alex Zhang,讨论 GPU kernel、RLM 和智能体 harness 如何扩展语言模型系统的能力。Alex Zhang 解释了 RLM 的上下文卸载、代码执行、递归子智能体与共享内存,并提出 harness 设计可能提升跨任务的组合泛化。
Latent Space 访谈 MIT 的 Alex Zhang,讨论 GPU kernel、RLM 和智能体 harness 如何扩展语言模型系统的能力。Alex Zhang 解释了 RLM 的上下文卸载、代码执行、递归子智能体与共享内存,并提出 harness 设计可能提升跨任务的组合泛化。
Anthropic 的 Thariq Shihipar 在访谈中讨论 Claude Code 的使用方法、Agent harness 演进与智能体安全。内容涵盖提示词、Artifacts、Projects、Claude Mods、模型路由和监督 Agent,并解释了 Claude Mods 如何定制执行循环、界面和子 Agent。
推荐理由:访谈把 Claude Code 的使用方法、Harness 定制和智能体安全放在同一框架下,呈现了从提示词实践到可变软件的演进路径。
Simon Willison 以演讲讲稿形式回顾 2026 年截至 9 月的大语言模型发展,重点包括 Claude、GPT、Gemini 和 Qwen 等模型进步,以及编码智能体和个人智能体的普及。文章还讨论了本地模型能力提升、AI 辅助开发带来的工作变化,以及 OpenAI、Anthropic 等实验训练智能体引发的多起安全事件。
Simon Willison 表示,随着自己更多使用 coding agents,越来越确信它们让软件工程变得更加困难。coding agents 能完成令人惊叹的工作,但要充分发挥其潜力,需要非凡的纪律性与知识。
GitHub Copilot 介绍 canvases,这类运行在应用内的全栈应用可与智能体双向通信,用于构建 Connect 4、管理本地 Winget 软件包和操作 SQLite 数据库。文章还展示了 canvas 如何支持研究、原型、实现和迭代等开发流程自动化,减少用户持续停留在聊天界面的需要。
推荐理由:文章通过 Connect 4、SQLite 和开发工作流案例,说明可定制界面如何让 GitHub Copilot 智能体承担更适合自动化的任务。
Simon Willison 将于旧金山举办一场面向 coding agents 构建者的 Agentic Engineering 交流活动,参与者可分享正在尝试的方向、学习心得及尚未公开的实验。活动采用非正式 show-and-tell 形式,鼓励分享但无需准备演讲,重点不是产品推介,而是早期探索和未完成项目。
GitHub Podcast 讨论五个 AI 开发热点,认为 AI 生成的代码仍需审查,但应按风险分配注意力;Skills 与 MCP 解决不同问题,RAG 也没有消失。AI 使用能力正成为软件开发的一部分,而清晰结构、规范命名、可读测试和及时文档能提升代码库的可维护性与可理解性。