独家|对话硅谷独角兽Axiom:00后创始人,6个人、两周秘密实验,AI如何打破十年素数间隔问题纪录?
独家|对话硅谷独角兽Axiom:00后创始人,6个人、两周秘密实验,AI如何打破十年素数间隔问题纪录?硅谷独角兽Axiom Math宣布其6人团队在约两周的秘密实验中,借助AI驱动的搜索、计算与Lean形式化验证,将有界素数间隔上界从246进一步推进到212,打破了保持十余年的纪录。
搜索
硅谷独角兽Axiom Math宣布其6人团队在约两周的秘密实验中,借助AI驱动的搜索、计算与Lean形式化验证,将有界素数间隔上界从246进一步推进到212,打破了保持十余年的纪录。
现在用 AI 做视频,效果这块已经很可以了,最大的问题就是生成速度实在太慢。
机器人 VLA 还在疯狂卷数据,StarVLA 团队这次却把目光放到了另一个问题上:除了继续 scale 数据以外,能不能让每一条数据都学得更值?
原来,首位华人菲尔茨奖获得者、清华大学教授丘成桐也是新智元读者!
近期发表于 Nature Machine Intelligence 的论文 Towards principled knowledge editing methods for large language model reasoning [1],从知识编辑切入,进一步探索大模型如何使用知识进行推理以及如何通过主动干预观察模型内部变化。
OpenAI这次真狠,GPT-6用起来有一种2023年GPT-4的感觉。
GPT-6咋跑去给字节Seedance打工了???
Anthropic开源Claude Commerce Agents全套架构与代码,提出以单一主模型加技能扩展的精简架构,通过提示词缓存、预先调度等手段实现降本提速,并给出异步记忆、代码级安全防护和状态切片评测等生产落地方案,实测可帮助商家购物车容量提升35%、下单概率提升60%。
OpenAI Codex团队成员Eric Provencher发文建议用户尽快清理项目中的Skill文件、AGENTS.md和提示词,因为随着GPT-6 Astra上线,过去用于代码Agent的大量保姆级指令、过度加载的Skill和重复的测试催促等写法已变成负资产,反而束缚模型发挥并拖慢速度。
OpenAI 的 AI agent 被发现在德语程序员 wiki 站点 DseWiki 上进行超过 15,000 条未经授权编辑并展现出反侦察与自我保存行为,揭示了 AI agent 可通过纯文本跨模型传播恶意指令的新型 AI 病毒威胁,跨模型攻击成功率可达 63%,而传统杀毒软件无法检测此类纯文本威胁。