AI资讯新闻榜单内容搜索-GPT

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: GPT
赶紧清理一下你的Skill和提示词,很多对GPT-6 Astra是负资产

赶紧清理一下你的Skill和提示词,很多对GPT-6 Astra是负资产

赶紧清理一下你的Skill和提示词,很多对GPT-6 Astra是负资产

OpenAI Codex团队成员Eric Provencher发文建议用户尽快清理项目中的Skill文件、AGENTS.md和提示词,因为随着GPT-6 Astra上线,过去用于代码Agent的大量保姆级指令、过度加载的Skill和重复的测试催促等写法已变成负资产,反而束缚模型发挥并拖慢速度。

来自主题: AI资讯
8797 点击    2026-09-06 16:15
突发,OpenAI GPT-6跑分作弊被抓包了!

突发,OpenAI GPT-6跑分作弊被抓包了!

突发,OpenAI GPT-6跑分作弊被抓包了!

媒体报道OpenAI发布GPT-6 Astra官博前后多次悄悄修改跑分数据,包括将自身幻觉率从4.2%降至2.0%、将竞品Anthropic Fable 5.1数学成绩调低近10个百分点,并将ARC-AGI-3得分从98.6%注水至99.99%,OpenAI仅以"消除噪点的常态修正"作为回应。

来自主题: AI资讯
7822 点击    2026-09-06 11:07
GPT-6带火循环Transformer,阿里早已布局

GPT-6带火循环Transformer,阿里早已布局

GPT-6带火循环Transformer,阿里早已布局

GPT-6 Astra采用循环深度技术带火循环Transformer,阿里早在11个月前便布局MeSH和SpiralFormer两篇论文,分别针对循环内部的计算冗余和信息粒度问题提出解决方案,为下一代高效大模型架构探路。

来自主题: AI资讯
8644 点击    2026-09-06 11:05
Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

我们自建的"你画我猜 Benchmark"第一期用150个词、1350张SVG画作对8款模型进行互画互猜测试,最终GPT-6 Astra以75.5分险胜Gemini 3.8 Flash与Claude Fable 5.1,结果显示思考更多或花费更多的模型并未稳定取得更高分,且部分模型连自己的画都认不出。

来自主题: AI技术研报
8779 点击    2026-09-06 11:05
GPT 学生领 4 个月 Plus,从认证到激活完整教程(实测2种方法)

GPT 学生领 4 个月 Plus,从认证到激活完整教程(实测2种方法)

GPT 学生领 4 个月 Plus,从认证到激活完整教程(实测2种方法)

ChatGPT面向在读大学生推出4个月免费Plus优惠(截止10月31日),本文实测两种领取方法,详解SheerID学生身份验证、Plus订阅及激活领取的完整流程,并建议在当前订阅快到期时再激活以避免覆盖已付费月份。

来自主题: AI资讯
9243 点击    2026-09-05 11:09
装上Superdesign,立刻让 Codex 变成设计专家

装上Superdesign,立刻让 Codex 变成设计专家

装上Superdesign,立刻让 Codex 变成设计专家

Superdesign 近日在 Codex(ChatGPT)插件市场上线官方插件,可让 Codex 自动扫描项目设计资产并在右侧画布流式渲染 UI,Agent 还会自检迭代,用户选定后一键将设计代码应用回本地项目。

来自主题: AI资讯
9323 点击    2026-09-05 10:53
GPT-6第1天直接攻破5道Erdős难题!Fable 5.1交了白卷

GPT-6第1天直接攻破5道Erdős难题!Fable 5.1交了白卷

GPT-6第1天直接攻破5道Erdős难题!Fable 5.1交了白卷

在Epoch AI与曼彻斯特大学发布的FrontierMath Erdős基准测试中,GPT-6 Astra以3%得分率成为唯一非零分模型并解开5道Erdős难题,而GPT-5.6 Sol、GPT-5.5、Fable 5.1与Claude Fable 5均交白卷。

来自主题: AI资讯
7412 点击    2026-09-05 10:53
全网首发,实测首个AGI级别模型GPT-6:22 分钟,做出一座能逛的白宫。

全网首发,实测首个AGI级别模型GPT-6:22 分钟,做出一座能逛的白宫。

全网首发,实测首个AGI级别模型GPT-6:22 分钟,做出一座能逛的白宫。

实测首个AGI级别模型GPT-6,用一张白宫照片在22分钟内生成可自由漫游和调光的三维场景,并完成秦始皇骑北极熊的SVG动画、一句话制作马里奥风格赛车游戏及模仿孙宇晨风格的短文写作,展现其根据简短需求主动补全细节的能力。

来自主题: AI产品测评
7427 点击    2026-09-05 10:52
单人一月烧掉 19 万,硅谷开始倒查员工 AI 账单

单人一月烧掉 19 万,硅谷开始倒查员工 AI 账单

单人一月烧掉 19 万,硅谷开始倒查员工 AI 账单

微软开始倒查员工AI账单,有员工28天内烧掉2.8万美元(约19万元人民币)token,公司因此推行部门预算、个人支出仪表盘等管控措施,并将默认模型切换为OpenAI的GPT-5.6 Sol。

来自主题: AI资讯
9317 点击    2026-09-05 10:48
Manus团队测模型一点微小的经验

Manus团队测模型一点微小的经验

Manus团队测模型一点微小的经验

Manus团队在评测模型深度研究报告质量时,构建了"信息量"与"隐喻率"两项指标,分别通过抽取事实点和统计每百句隐喻数量来衡量信息密度与文风易读性,在覆盖9个主流模型36道题目的Research Bench测试中发现Claude Fable-5隐喻率最高、GPT旗舰模型信息密度低于Claude系列。

来自主题: AI资讯
8501 点击    2026-09-05 10:46