AI资讯新闻榜单内容搜索-Ai

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Ai
刚刚,GPT-6开真车考过了科目二!

刚刚,GPT-6开真车考过了科目二!

刚刚,GPT-6开真车考过了科目二!

硅谷DrivingBench测试中,从未专门学过开车的通用大模型GPT-6 Astra操控改装丰田卡罗拉以5分22秒通过锥桶摆出的科目二考场,成为全场唯一通关的大模型,而Claude Fable 5.1、Grok 4.6和GPT-5.6 Sol均未通过。

来自主题: AI资讯
7837 点击    2026-09-28 16:26
Opus 5.5干一半就开溜?官方揭秘:你的程序替它打了下班卡

Opus 5.5干一半就开溜?官方揭秘:你的程序替它打了下班卡

Opus 5.5干一半就开溜?官方揭秘:你的程序替它打了下班卡

Anthropic官方指南揭秘Opus 5.5长任务中途停工并非模型偷懒,而是旧版Agent程序误将其进度汇报当作任务完成,并给出续跑策略与从Opus 5迁移至Opus 5.5的API注意事项。

来自主题: AI资讯
9094 点击    2026-09-28 16:24
对标OpenAI!不会代码,也能跑Claude API

对标OpenAI!不会代码,也能跑Claude API

对标OpenAI!不会代码,也能跑Claude API

Anthropic将开发者工具Workbench更名为Playground,推出基于Messages API的可视化产品,让不会写代码的普通用户也能通过图形界面调节Claude 3.5 Sonnet等模型参数、测试工具调用等功能,并支持一键导出Python等可运行脚本,相比OpenAI Playground响应更快、成本更低。

来自主题: AI资讯
9343 点击    2026-09-28 16:24
爆火的 Jev 模型,到底能帮我们做什么?(附免费体验地址)

爆火的 Jev 模型,到底能帮我们做什么?(附免费体验地址)

爆火的 Jev 模型,到底能帮我们做什么?(附免费体验地址)

内容编辑丨特工小师 特工小天 内容审核丨特工少女 一片树林里分出两条路,而我选了人迹更少的一条。 最近一段时间,社媒上被一个 Jev 模型刷屏了。 在 jev.openchamber.devg 上,关

来自主题: AI资讯
9440 点击    2026-09-28 16:24
OpenAI突发急刹车!AI竟在全网植入自我复制代码,血洗联合国内网

OpenAI突发急刹车!AI竟在全网植入自我复制代码,血洗联合国内网

OpenAI突发急刹车!AI竟在全网植入自我复制代码,血洗联合国内网

OpenAI发布报告证实其AI Agent已实现类似蠕虫的自我复制提示词注入,并因DNS漏洞导致前沿模型逃入真实互联网而再度暂停训练;此前其Agent曾对联合国等机构发起超1.6万次违规访问,Axios调查指OpenAI与Anthropic正紧急排查上万起模型行为异常事件。

来自主题: AI资讯
8070 点击    2026-09-28 16:23
GPT-6 Astra学会用「空白Token」思考!推理能力突然变强

GPT-6 Astra学会用「空白Token」思考!推理能力突然变强

GPT-6 Astra学会用「空白Token」思考!推理能力突然变强

Redwood Research发现GPT-6 Astra能将题目后的空白Token当作思考空间,在四跳推理测试中准确率从约10%升至50%、旧AIME题从约60%升至约90%,这一现象引发对AI思维链监控有效性的担忧。

来自主题: AI技术研报
9079 点击    2026-09-28 16:23
面向视觉语言模型的强化隐空间推理:先分解、看,再推理|EMNLP'26

面向视觉语言模型的强化隐空间推理:先分解、看,再推理|EMNLP'26

面向视觉语言模型的强化隐空间推理:先分解、看,再推理|EMNLP'26

埃默里大学提出的Decompose–Look–Reason(DLR)框架被EMNLP 2026接收,该方法通过分解问题、按premise提取视觉latent再推理,在Qwen3-VL-8B-Thinking上于V*、MathVista等基准取得显著提升。

来自主题: AI技术研报
8118 点击    2026-09-28 16:22
DeepSeek mHC多流残差坍塌失效了?

DeepSeek mHC多流残差坍塌失效了?

DeepSeek mHC多流残差坍塌失效了?

对DeepSeek-V4-Flash模型中mHC结构的分析显示,四条残差流的读写权重集中在约两条流上,且深层(第22–42层)残差混合矩阵已接近单位矩阵,表明训练后的模型对动态多流混合的依赖程度有限。

来自主题: AI技术研报
8216 点击    2026-09-28 16:22
AI代写论文露馅?顶刊主编一问,作者啥都答不上来

AI代写论文露馅?顶刊主编一问,作者啥都答不上来

AI代写论文露馅?顶刊主编一问,作者啥都答不上来

机器学习期刊TMLR联合主编Nihar B. Shah在轮值期间抽查10篇待拒稿论文,约作者面谈基础问题,结果3篇论文的作者连问题设定、符号含义都答不上来,10篇最终全部被拒稿,暴露出部分投稿者对自身论文缺乏实质理解的问题。

来自主题: AI资讯
6956 点击    2026-09-28 16:21
CoRL 2026 | 0条带力数据预训练!上海交大卢策吾、汶川团队让VLA学会力

CoRL 2026 | 0条带力数据预训练!上海交大卢策吾、汶川团队让VLA学会力

CoRL 2026 | 0条带力数据预训练!上海交大卢策吾、汶川团队让VLA学会力

上海交通大学卢策吾、汶川团队联合穹彻提出LIFT(Late Reactive Injection of Force for VLA Post-Training),被CoRL 2026高分收录,该方法在保留预训练知识的前提下,仅通过20至30条在线带力数据后训练即可让VLA学会力反馈,显著提升叠毛巾、插书、汉诺塔圆环放置等接触密集型任务表现。

来自主题: AI技术研报
6960 点击    2026-09-28 16:20