迈向长程智能体,人大高瓴发布149页全景综述
迈向长程智能体,人大高瓴发布149页全景综述我们想强调的是:智能体 “跑得久”,并不等于 “具备长程能力”。真正的关键,不在于占用更多时间与算力,而在于能否在更长、更复杂、更真实的推理依赖链上持续、有效地行动。长期以来,Autonomous Agent、Self-Evolving Agent 等概念常与长程智能体混用。
搜索
我们想强调的是:智能体 “跑得久”,并不等于 “具备长程能力”。真正的关键,不在于占用更多时间与算力,而在于能否在更长、更复杂、更真实的推理依赖链上持续、有效地行动。长期以来,Autonomous Agent、Self-Evolving Agent 等概念常与长程智能体混用。
Agent 执行任务的时候,会反复踩坑、不断试错,最后积累一些正确的经验。但这些经验通常只能停留在当前会话,或者当前 Agent 的记忆里,很难传给其他 AI。一个 Agent 调用某个 API,花了半个小时查文档、改参数,连续失败好几次,最后终于找到正确方法。
刚刚,在年度AMD Advancing AI大会上,AMD董事会主席兼CEO苏姿丰博士连放大招,发布AMD最强AI芯片Instinct MI455X GPU、“最强智能体CPU”Venice、“最强机架级AI基础设施”Heilos,还有一款专为机器人设计的Ryzen芯片。
一次错误回答,可能只会让用户关掉页面;一次错误执行,却可能改写企业数据库、触发一笔交易,甚至让整条业务流程偏离轨道。
据The Information独家报道,Taylor目前所领导的AI客户支持初创公司Sierra正在收购Thumaty创办的三人初创公司Takeoff,后者开发的Agent能够长时间持续处理各类任务。Sierra高管希望,随着公司试图从AI驱动的客户支持Agent业务拓展到销售面向其他任务的Agent,Thumaty的专业经验将大有助益。
在过去一年里,我的发票、合同、申请表,全是 claude code 帮我弄的,着实省了不少功夫,但也积累下来了不少抱怨:格式我能自定的还好,直接生成网页版直接打印。最怕对方发来一个固定格式的 Word,只能在指定位置改,直接哭瞎
开源一周多,DojoAgents 已经在 GitHub 获得超过 1000 个 Star。DojoAgents 项目受到关注,是因为其并不只是一个能回答投资问题的 Agent,而是一种新的金融决策辅助方式:让 AI 不再停留在生成答案,而是形成对金融世界持续更新的理解,并在数据、工具、权限和风险边界内,长期且持续主动地推进研究与决策辅助任务。
刚刚,北京市发布了一份特别重磅的政策文件。《北京市关于加快智能体引领发展的若干措施》文件不长,一共10条。但我把它从头到尾看完以后,我的第一反应是,这份政策真的有点太新了。Agentic AI、Harness Engineering、AI OS、FDE、OPC、Token经济、TaaS、AaaS、RaaS、Token工厂、AIP。
最近手头在测一个新模型,叫 Macaron-V1。说实话一开始没抱太大期待,打着「个人智能体」旗号的产品这两年太多了,大多数打开之后还是那套老配方:一个聊天机器人,外面挂几个插件。但测了三四天下来,发现这个模型的思路跟我预想的不太一样,值得认真写一篇。
今天,腾讯正式发布了其首个研究智能体(Research Agent)——Hyra(Hunyuan Research Agent)。Hyra能够像科研人员一样,提出假设、完成实验、总结经验,再基于经验不断提出新的方案,最终实现递归自我改进(Recursive Self-Improvement,RSI)。