禁掉所有工具后,Opus 5和GPT-5.6的差距终于藏不住了
禁掉所有工具后,Opus 5和GPT-5.6的差距终于藏不住了且不论性能,自Claude Opus 5发布以后有一件事让AI圈特别在意,就是Anthropic在提示词上的改进。
搜索
且不论性能,自Claude Opus 5发布以后有一件事让AI圈特别在意,就是Anthropic在提示词上的改进。
Claude这次,真把AI编程榜单打出断层了!就在刚刚刷新的MirrorCode排行榜上,Claude Fable 5以64%的绝对成功率再次登顶。 排在第四的GPT-5.5更惨。不仅成绩只有10%,甚至还被自家前辈GPT-5.4按在地上摩擦。
今天,OpenAI重磅放出一份长达62页的「核心手稿」,详细展示了GPT的完整推演。传送门:https://cdn.openai.com/pdf/reasoning-walkthroughs.pdf。它的「摘要」只有一小段,但信息量却大得惊人——这份笔记由AI模型独立撰写,OpenAI团队完全没有插手。
GPT-5.6 Sol 推翻 100 多年前的麦克斯韦猜想,下一代模型突破 10 个!数学家菲利普·阿拉图恩、加文·鲍尔和马修·D·克瓦尔海姆于 2026 年 7 月 29 日在 arXiv 上发表论文,提到由 GPT-5.6 Sol 找到了一个反例,证明了 100 多年前的麦克斯韦猜想是假的。
刚刚完成 GPT-5.6 系列模型的大降价,OpenAI 又传出了新模型的消息。 据外媒 The Information 报道,OpenAI 正准备发布一个新的模型系列,目前暂定名为 Astra。该系列在执行长时间任务方面的能力将有所提升。
今日,OpenAI宣布下调GPT-5.6系列模型API价格。其中,GPT-5.6 Luna价格下调80%,GPT-5.6 Terra价格下调20%,GPT-5.6 Sol则新增Fast模式,在保持模型能力不变的情况下,最高可实现2.5倍推理速度。
这回,AI开始为自己写代码了!
成本砍20%、效率提升15%。
最近 Claude 又开始大面积封号,我的主号终究也没能幸免。
作为一个普通人,如果你把一道数学难题给到 AI,并一直让它「继续」,它有没有可能真的把这道题解出来,从而帮你赢得一大笔奖金,甚至改写数学发展进程?