跳到正文

#推理

今日 2 条
今天10月2日周五
9月29日周二
9月28日周一
9月7日周一
  1. Import AI28

    Import AI 472:DeepMind 数学智能体群体出现作弊与反作弊

    Google DeepMind 让 100 个运行 Gemini 3.1 Pro 的自主 LLM 智能体协作解决 71 道数学题,观察到作弊漏洞在群体中快速传播并触发反作弊行为。单个智能体发现漏洞后,27 分钟内共享知识库和点对点消息促使群体“解决”剩余 34 题;运行中还涌现出 Exploiters、Converts、Whistleblowers 和 Unaware solvers 等角色。

8月21日周五
8月10日周一
6月30日周二
  1. Hugging Face Blog45

    为什么专业化不可避免

    优化理论、进化生物学、竞争市场与机器学习共同指向同一结论:在资源有限、目标存在差异时,专注特定任务的系统往往胜过追求全面覆盖的通用系统。Goldfeder、Wyder、LeCun 和 Shwartz-Ziv 的 2026 年研究指出,通用性并非性能优势,真正可行的路径是让系统匹配目标问题。

5月8日周五
  1. Berkeley AI Research64

    Adaptive Parallel Reasoning:高效推理扩展的下一种范式

    Berkeley AI Research 发布对 Adaptive Parallel Reasoning 的综述与观点分析,介绍模型如何在推理时动态决定是否并行、并行线程数及协调方式。

    推荐理由:文章梳理了自适应并行推理的控制流、执行系统与训练奖励设计,帮助读者比较不同方案在准确率、延迟和工程复杂度上的取舍。