实测美团CatPaw:这只猫爪,抓得还算稳
实测美团CatPaw:这只猫爪,抓得还算稳7月27日,美团正式上线了CatPaw,一个全场景AI Agent平台。准确说,是「内部练了三年,现在放出来给所有人用」。
搜索
7月27日,美团正式上线了CatPaw,一个全场景AI Agent平台。准确说,是「内部练了三年,现在放出来给所有人用」。
一个Agent可以完整读过任务要求,亲手执行过失败命令,也能在十分钟前准确定位错误根因,但到了下一轮决策,它仍可能像第一次遇到问题一样重走旧路:再次写入已经确认不可写的目录,重新尝试已经被证伪的参数,或者修好局部测试后忘掉最初的验收条件。
它把架构、训练和 Agent infra连接成了一套完整系统。
传统的业务指标,正在让 AI Agent 产品经理陷入“打地鼠”式的优化困境。
还记得「苦涩的教训」(The Bitter Lesson)吗?
即使到了人手 N 个 Agent 产品的时代,大部分人还在用 Agent 产品的默认搜索与策略。
让 Agent 上网查资料,已经不算新鲜事。
很多开发者对 AnySearch 应该都不陌生,Github Star 6000+,上线首月狂揽全球10万开发者用户。在Product Hunt上,它也是周榜第一。前几天去了AnySearch组织的活动,启发比想象中更大。
就在刚刚,全球首个3万亿参数级开源模型Kimi K3正式开源!https://github.com/MoonshotAI/Kimi-K3/tree/main。Moonshot AI宣布,发布Kimi K3的模型权重、技术报告,并开源支撑Kimi K3模型训练的关键Infra技术:MoonEP、FlashKDA和AgentEnv。
上周我们发了一篇Agent大横评的文章三家评测,结果评论区出现了一个高频问题: “字节的TRAE Work建议测一下。”