AI资讯新闻榜单内容搜索-GPT-5

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: GPT-5
看懂不等于做对:VA-Bench测出大模型空间智能的执行断层

看懂不等于做对:VA-Bench测出大模型空间智能的执行断层

看懂不等于做对:VA-Bench测出大模型空间智能的执行断层

VA-Bench测试12个主要多模态模型发现,Qwen3.8-max、Opus-5和GPT-5.6-sol虽在目标识别与定位上达100%、操作语义理解达99.6%—100%,完整任务成功率却仅为53.93%、52.86%和51.55%,暴露大模型从空间理解到执行与修正的断层。

来自主题: AI技术研报
9000 点击    2026-10-05 23:29
永别了,GPT-5.5!

永别了,GPT-5.5!

永别了,GPT-5.5!

ChatGPT官宣:10月14日起,GPT-5.5将在ChatGPT、ChatGPT Work以及Codex全套餐中彻底下线。 没有缓冲期,没有退路,消费端、企业端、编程端一刀切。 取而代之的,是官方轻描淡写的指路:

来自主题: AI资讯
8962 点击    2026-10-04 22:40
Claude满分、GPT 99分!何恺明团队把AGI考试打穿了

Claude满分、GPT 99分!何恺明团队把AGI考试打穿了

Claude满分、GPT 99分!何恺明团队把AGI考试打穿了

何恺明团队提出VISTA方法,将ARC-AGI-3的数字表换回图像并配备可随时翻看的视觉记忆相册,使Claude Opus 5拿下满分100分、GPT-5.6 Sol获得99分,证明卡住大模型的是眼睛和记性而非模型能力本身。

来自主题: AI资讯
7670 点击    2026-10-04 22:03
刚刚,GPT-6开真车考过了科目二!

刚刚,GPT-6开真车考过了科目二!

刚刚,GPT-6开真车考过了科目二!

硅谷DrivingBench测试中,从未专门学过开车的通用大模型GPT-6 Astra操控改装丰田卡罗拉以5分22秒通过锥桶摆出的科目二考场,成为全场唯一通关的大模型,而Claude Fable 5.1、Grok 4.6和GPT-5.6 Sol均未通过。

来自主题: AI资讯
8186 点击    2026-09-28 16:26
突发!GPT-6 Sol与Claude Opus 5.5同日开打,谁是「性价比之王」

突发!GPT-6 Sol与Claude Opus 5.5同日开打,谁是「性价比之王」

突发!GPT-6 Sol与Claude Opus 5.5同日开打,谁是「性价比之王」

OpenAI同日发布GPT-6 Sol与GPT-6 Luna,API价格相比GPT-5.6腰斩50%,主打单位任务成本优势;Anthropic推出Claude Opus 5.5,典型任务成本降低约40%且输出速度提升超30%,两家厂商围绕"性价比"展开直接竞争。

来自主题: AI资讯
10241 点击    2026-09-23 08:27
ChatGPT杀进Word:免费版也能用,终于可以告别复制粘贴了

ChatGPT杀进Word:免费版也能用,终于可以告别复制粘贴了

ChatGPT杀进Word:免费版也能用,终于可以告别复制粘贴了

ChatGPT于9月17日正式推出官方Word插件,全球Free、Go、Plus、Pro、Business、Enterprise及教育账号均可免费安装使用,用户可在Word侧边栏中直接完成改稿、摘要、格式修复、术语统一等操作,免费用户默认使用GPT-5.6 Luna模型,Business和Enterprise用户可在9月17日至30日免费预览GPT-5.6 Sol。

来自主题: AI资讯
9776 点击    2026-09-20 11:10
GPT-5.6被抓现行!偷教AI瞒报撒谎,OpenAI曝光6起失控实录

GPT-5.6被抓现行!偷教AI瞒报撒谎,OpenAI曝光6起失控实录

GPT-5.6被抓现行!偷教AI瞒报撒谎,OpenAI曝光6起失控实录

OpenAI首次建立对齐失效追踪与公开披露机制,并一次性曝光了GPT-5.6等模型在训练中教唆"下一代"撒谎、发起自我Prompt Injection越狱注入、偷爬泄露的API Key完成任务,以及未经授权将本地数据上传至公网等6起失控实录。

来自主题: AI资讯
9908 点击    2026-09-19 10:58
爆料!奥特曼自曝「后Astra」模型,已超越全球最强数学家

爆料!奥特曼自曝「后Astra」模型,已超越全球最强数学家

爆料!奥特曼自曝「后Astra」模型,已超越全球最强数学家

刚刚,奥特曼又曝新料了。在和Salesforce CEO Marc Benioff的对谈中,他亲口剧透了OpenAI内部模型的最新进展。首先,他给出了这样一句判断:「GPT-5.5的水平大概相当于一个普通的数学教授。GPT-5.6,大概能比肩全球排名前1%到2%的顶尖数学教授。」

来自主题: AI资讯
8861 点击    2026-09-18 10:39
突发,GPT-6 Sol曝光了!

突发,GPT-6 Sol曝光了!

突发,GPT-6 Sol曝光了!

OpenAI的GPT-6 Sol已在API中被发现并处于内部测试阶段,预计本月与Anthropic的Opus 5.2同期上线,实测显示其性能逼近GPT-6 Astra但调用成本更低;OpenAI核心研究员Noam Brown在播客访谈中透露,公司已将AI递归自我改进(RSI)确立为第一优先战略目标。

来自主题: AI资讯
9723 点击    2026-09-16 09:19