GPT-5.6一小时解开50年数学猜想,700词Prompt驾驭64个子Agent
GPT-5.6一小时解开50年数学猜想,700词Prompt驾驭64个子Agent昨儿刚出的GPT-5.6,用不到一小时,就完成了一道存在了半个世纪的图论猜想证明。而这道题呢,来头也还真不小,就是大名鼎鼎的循环双覆盖猜想(Cycle Double Cover Conjecture)。
搜索
昨儿刚出的GPT-5.6,用不到一小时,就完成了一道存在了半个世纪的图论猜想证明。而这道题呢,来头也还真不小,就是大名鼎鼎的循环双覆盖猜想(Cycle Double Cover Conjecture)。
微软Copilot & Agents Core总裁Nitin Agrawal说,「迫不及待想让客户看到GPT-5.6能做什么」——不管是起草文档、分析数据、做演示,还是跨团队协作,产出都会更精致。除了原生接入模型,微软还会直接通过OpenAI API调用GPT-5.6,服务Microsoft 365客户。双通道,齐上阵。
一夜之间,Codex 大改版迎来风评反转。先看网友 signulll 的暴击:「你们把地球上最熟悉的 AI 产品,按自己的组织架构图重新设计了一遍。绝了。」博主 M.G. Siegler 更是直接发文,标题就叫《ChatGPT 的超级 App 简直糟糕烂透了》。他上手几个小时后的体验大概是这样的:
7 月 9 日,OpenAI 一口气发了三样东西,新模型 GPT-5.6,一个把 Chat、Work、Codex 装进同一个壳的新桌面应用,以及本文的主角 ChatGPT Work。官方的说法是,ChatGPT 从此不再只是回答问题,而是把活真正干完,交出来的不是聊天记录,是表格、文档、PPT,甚至一个能直接分享的网站。
6月26日,奥特曼公开说:应白宫要求,GPT-5.6今天只能限量预览,我们正在和美国政府合作,尽快推进全面开放。刚刚,白宫与商务部紧急出面「澄清」,极力撇清关系。政府官员对媒体明确表示:大模型的发布不需要任何政府许可,分发决定权「完全在企业手中」,所谓的安全测试与会议也「完全是自愿的」
与模型更新相对应,原先的 Codex 应用改名为「ChatGPT Codex」,完全更新了一轮。它被做成了所谓的超级应用,界面也几乎重新设计了一遍,把 ChatGPT 与 Codex 结合到了一起。下面说一说现在的 ChatGPT Codex 到底该怎么用,出一个新手的完全究极教程。
就在刚刚,GPT-5.6 系列正式登场,一口气发布三个型号:旗舰 Sol、均衡款 Terra,还有主打性价比的 Luna,名字分别取自拉丁语里的太阳、地球/大地和月亮。价格上,Sol 每百万 token 输入 5 美元、输出 30 美元;Terra 直接减半,2.5 美元和 15 美元;Luna 最便宜,只要 1 美元和 6 美元。
今天 AI 圈的国际头版头条,比往常还要激烈。前有收获不少好评的 Grok-4.5,后有虎视眈眈的 GPT-5.6。结果就在刚刚,Meta 超级智能实验室 (MSI) 杀出, 甩出新模型 Muse Spark 1.1。
今天凌晨,OpenAI进行线上直播,正式面向全球用户推出新一代GPT-5.6模型家族,并同步发布Agent产品ChatGPT Work、全新ChatGPT桌面应用以及Hosted Sites(托管网站)三大产品更新。
从ChatGPT掀起生成式AI浪潮到现在,不过短短两三年,AI能力的进化速度已经让"AI自我进化"这件事从科幻走进了现实。上个月,Anthropic在一份公开报告中预测,AI未来将进入"递归自我提升"(Recursive Self-Improvement, RSI)阶段,并呼吁人类共同为AI的发展设计出一个减速或暂停机制。