别让Agent瞎想乱搜还闯祸:哪些能力该内化进模型,哪些必须交给Harness,这篇讲透
别让Agent瞎想乱搜还闯祸:哪些能力该内化进模型,哪些必须交给Harness,这篇讲透北航、南方科技大学、复旦大学、北京理工大学、爱丁堡大学等 8 家机构的 19 位研究者联合完成 Theory of Agent 综述,讨论模型内部与外部 harness 应如何分配能力,并据此梳理 LLM Agent 的学习、对齐、演化与评测。
搜索
北航、南方科技大学、复旦大学、北京理工大学、爱丁堡大学等 8 家机构的 19 位研究者联合完成 Theory of Agent 综述,讨论模型内部与外部 harness 应如何分配能力,并据此梳理 LLM Agent 的学习、对齐、演化与评测。
把 On-Policy Distillation(在线策略蒸馏,OPD)的训练集从 17000 道题删到 1 道,会发生什么?
OpenAI的GPT-6 Sol已在API中被发现并处于内部测试阶段,预计本月与Anthropic的Opus 5.2同期上线,实测显示其性能逼近GPT-6 Astra但调用成本更低;OpenAI核心研究员Noam Brown在播客访谈中透露,公司已将AI递归自我改进(RSI)确立为第一优先战略目标。
OKEight(回了么)是程梦琪团队开发的AI回复工具,它为每位联系人维护本地人物卡,学习用户与不同人的沟通风格,在Mac端读取当前对话生成候选回复,并记录未完成的约定和事项。
过去两周里,「循环深度」这个词变成了 AI 安全讨论的焦点。
成立才一个多月,估值就要冲到 500 亿美元。
OpenAI计划以3亿美金收购由前苹果工程师创立的AI影像公司Glass Imaging,以补充端侧视觉能力,布局多模态AI硬件。
Token词元替代了Byte字节,但不意味着大模型都得是Token。
Agent爆发时代,我们需要什么样的AI计算底座?
过去两周,AI圈最让人坐不住的三个字母,就是RSI。