GPT-5-Thinking新训练方法公开:让AI学会忏悔
GPT-5-Thinking新训练方法公开:让AI学会忏悔OpenAI搞了个新活:让ChatGPT自己“坦白从宽”。
OpenAI搞了个新活:让ChatGPT自己“坦白从宽”。
记忆,或是 AI 从「即时回答工具」迈向「个性化超级助手」的关键突破
继今年5月提出MeanFlow (MF) 之后,何恺明团队于近日推出了最新的改进版本—— Improved MeanFlow (iMF),iMF成功解决了原始MF在训练稳定性、指导灵活性和架构效率上的三大核心问题。
昨天晚上打开蚂蚁那个灵光,发现他们更新了一个很有趣的东西。
在人工通用智能(AGI)的探索征程中,具身智能 Agents 作为连接数字认知与物理世界的关键载体,其核心价值在于能够在真实物理环境中实现稳健的空间感知、高效的任务规划与自适应的执行闭环。
最近口述采样很火。如果您经常使用经过“对齐”训练(如RLHF)的LLM,您可能已经注意到一个现象:模型虽然变得听话、安全了,但也变得巨“无聊”。
当你阅读《红楼梦》《哈利·波特》《百年孤独》等长篇小说时,读着读着可能就忘记前面讲了什么,有时还会搞混人物关系。AI 在阅读长文章的时候也存在类似问题,当文章太长时它也会卡主,要么读得特别慢,要么记不住前面的内容。
叶问蹲、跳舞、跑步,一个策略全搞定!
如今 LLM 的语言理解与生成能力已展现出惊人的广泛适用性,但随着 LLM 的发展,一个事实越发凸显:仅靠语言,仍不足以支撑真正的智能。
马斯克脑机接口,又有新动态。