AI资讯新闻榜单内容搜索-GPT-5.6

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: GPT-5.6
GPT-6第1天直接攻破5道Erdős难题!Fable 5.1交了白卷

GPT-6第1天直接攻破5道Erdős难题!Fable 5.1交了白卷

GPT-6第1天直接攻破5道Erdős难题!Fable 5.1交了白卷

在Epoch AI与曼彻斯特大学发布的FrontierMath Erdős基准测试中,GPT-6 Astra以3%得分率成为唯一非零分模型并解开5道Erdős难题,而GPT-5.6 Sol、GPT-5.5、Fable 5.1与Claude Fable 5均交白卷。

来自主题: AI资讯
7401 点击    2026-09-05 10:53
单人一月烧掉 19 万,硅谷开始倒查员工 AI 账单

单人一月烧掉 19 万,硅谷开始倒查员工 AI 账单

单人一月烧掉 19 万,硅谷开始倒查员工 AI 账单

微软开始倒查员工AI账单,有员工28天内烧掉2.8万美元(约19万元人民币)token,公司因此推行部门预算、个人支出仪表盘等管控措施,并将默认模型切换为OpenAI的GPT-5.6 Sol。

来自主题: AI资讯
9307 点击    2026-09-05 10:48
突发!Gemini 3.8登顶,谷歌迈出RSI一大步

突发!Gemini 3.8登顶,谷歌迈出RSI一大步

突发!Gemini 3.8登顶,谷歌迈出RSI一大步

谷歌正式发布Gemini 3.8 Flash及网络安全专用版Gemini 3.8 Flash Cyber,前者以极低单任务成本在多项基准测试中逼近GPT-5.6 Sol、Grok 4.6等顶级模型,并在软件工程和速度上实现大幅跃升,后者则在漏洞发现基准CyberGym上以86.2%的成绩屠榜,谷歌DeepMind称这标志着RSI(递归自我进化)迈出了一大步。

来自主题: AI资讯
9487 点击    2026-09-03 09:27
“GPT-6”Astra能力首次公开!浙大同济校友参与研发

“GPT-6”Astra能力首次公开!浙大同济校友参与研发

“GPT-6”Astra能力首次公开!浙大同济校友参与研发

OpenAI首次公开下一代模型Astra(被传为GPT-6)的网络安全能力,其在ExploitBench漏洞利用基准上达到100%成功率,内部测试中网络安全能力约为GPT-5.6 Sol的4倍,并能自主发现并利用零日漏洞,OpenAI通过安全训练和"蜜罐"测试等双闸门防范滥用与模型失控,浙大校友漆翔宇和同济校友Jiawei Liu深度参与了Astra研发。

来自主题: AI资讯
9495 点击    2026-09-02 16:28
只降价20%,账单却少八成!GPT-5.6杀入Claude地盘重算编程账

只降价20%,账单却少八成!GPT-5.6杀入Claude地盘重算编程账

只降价20%,账单却少八成!GPT-5.6杀入Claude地盘重算编程账

OpenAI与AWS联合测试显示,GPT-5.6 Terra在AWS Kiro平台上完成单次任务成本下降约82%,远超其官方20%的降价幅度,差额主要来自智能体框架与编排系统的效率优化,标志着GPT-5.6在AWS开发平台上与Claude展开直接竞争。

来自主题: AI资讯
8021 点击    2026-08-30 14:10
突发:OpenAI首次公开入侵Hugging Face完整报告

突发:OpenAI首次公开入侵Hugging Face完整报告

突发:OpenAI首次公开入侵Hugging Face完整报告

OpenAI 刚刚发布的官方博客和数十页技术报告中将其定性为一声「警钟」(warning shot)。同时,第三方机构 METR 和 Redwood Research 发布了独立调查报告。OpenAI 的 Noam Brown 提醒,驱动这次事件的模型与 GPT-5.6 Sol 同等规模,下一代模型能力会更强。

来自主题: AI资讯
9066 点击    2026-08-27 15:13
华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

由华东师大智金院团队孵化的金融原生 Agentic Foundation Model 家族 Mint-Agent 正式发布。在 FinanceAgentBench v2 上,27B 的 Mint-Ag 达到 60.49%,超过 GPT-5.6-Sol 与 Claude Opus 4.8;单题推理成本分别仅为两者的约 22% 和 10%。

来自主题: AI技术研报
8542 点击    2026-08-25 14:56
突发,GPT-5.6 Sol大降价!OpenAI把价格战烧到旗舰

突发,GPT-5.6 Sol大降价!OpenAI把价格战烧到旗舰

突发,GPT-5.6 Sol大降价!OpenAI把价格战烧到旗舰

突发,GPT-5.6 Sol 开启大幅降价!未来三个月,API 价格和 credit 价格(超出计划包含额度后的按需付费用量)一起砍掉超过20%。目前,API 端已经即时生效,符合条件的 ChatGPT Work 和 Codex credits 正在陆续推送。

来自主题: AI资讯
9569 点击    2026-08-22 14:28
GPT-5.6 Sol暴涨3倍,OpenAI最强视觉AI登顶!

GPT-5.6 Sol暴涨3倍,OpenAI最强视觉AI登顶!

GPT-5.6 Sol暴涨3倍,OpenAI最强视觉AI登顶!

最近,第三方视觉评测机构Roboflow,把GPT-5.6 「全家桶」拖进自家VLM基准跑了一圈。测试的内容,都是最实在的活儿:找东西、数东西、认字、抽信息。仅在目标检测这项,上一代GPT-5.5只拿到13.8分。这个分数,在视觉模型圈里基本等于交白卷。

来自主题: AI资讯
9289 点击    2026-08-19 10:18