第三方机构实测:Agent 场景下,Kimi K3 反超 GPT-5.6 Sol
第三方机构实测:Agent 场景下,Kimi K3 反超 GPT-5.6 SolKimi K3 发布十天后,AI 原生云服务商 Together AI 公布了一份独立评测报告。
搜索
Kimi K3 发布十天后,AI 原生云服务商 Together AI 公布了一份独立评测报告。
《仅需》6.9亿个token、423美元和1条提示词,就能做出一款火遍全网的美式水上快艇竞速游戏。
GPT-5.6和Fable 5联手,解决了一道悬置25年的数学难题。微软研究院首席研究员Dimitris Papailiopoulos,证明了一个多项式时间算法,能让MIMO检测精确命中最大似然阈值。
新智元报道 不是吧? 连GPT-5.6,竟然全员免费了! 今早,OpenAI重磅官宣,GPT-5.6 Luna的文本对话,不限量了。 全球十亿人,直接免费用。 与此同时,GPT-5.6 Sol迎来全新
且不论性能,自Claude Opus 5发布以后有一件事让AI圈特别在意,就是Anthropic在提示词上的改进。
Claude这次,真把AI编程榜单打出断层了!就在刚刚刷新的MirrorCode排行榜上,Claude Fable 5以64%的绝对成功率再次登顶。 排在第四的GPT-5.5更惨。不仅成绩只有10%,甚至还被自家前辈GPT-5.4按在地上摩擦。
今天,OpenAI重磅放出一份长达62页的「核心手稿」,详细展示了GPT的完整推演。传送门:https://cdn.openai.com/pdf/reasoning-walkthroughs.pdf。它的「摘要」只有一小段,但信息量却大得惊人——这份笔记由AI模型独立撰写,OpenAI团队完全没有插手。
GPT-5.6 Sol 推翻 100 多年前的麦克斯韦猜想,下一代模型突破 10 个!数学家菲利普·阿拉图恩、加文·鲍尔和马修·D·克瓦尔海姆于 2026 年 7 月 29 日在 arXiv 上发表论文,提到由 GPT-5.6 Sol 找到了一个反例,证明了 100 多年前的麦克斯韦猜想是假的。
刚刚完成 GPT-5.6 系列模型的大降价,OpenAI 又传出了新模型的消息。 据外媒 The Information 报道,OpenAI 正准备发布一个新的模型系列,目前暂定名为 Astra。该系列在执行长时间任务方面的能力将有所提升。
今日,OpenAI宣布下调GPT-5.6系列模型API价格。其中,GPT-5.6 Luna价格下调80%,GPT-5.6 Terra价格下调20%,GPT-5.6 Sol则新增Fast模式,在保持模型能力不变的情况下,最高可实现2.5倍推理速度。