AI资讯新闻榜单内容搜索-端到端

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 端到端
形界智能Rise模型,让我看到了全新的交互

形界智能Rise模型,让我看到了全新的交互

形界智能Rise模型,让我看到了全新的交互

看到形界智能「Era」系列的原生模型Rise正式发布了,用500ms的端到端响应延迟,让人机交互,有了新的变量。第一时间测试了一下,给大家介绍介绍。全域沉浸,一种全新的视频交互形态

来自主题: AI资讯
9406 点击    2026-08-22 14:04
解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

视觉 - 语言 - 动作(VLA)模型已成为端到端自动驾驶的主流技术路线,但基于自回归(AR)解码的现有架构面临双重结构性瓶颈:其一,逐 Token 串行生成导致推理延迟随序列长度线性增长,严重制约实时部署;其二,训练阶段依赖真实前缀的 teacher forcing 机制,使模型在推理时暴露于自身生成的误差之上,引发长时序累积的曝光偏差(exposure bias)。

来自主题: AI技术研报
6891 点击    2026-08-19 14:39
机器人也有“Aha Moment”!Zetta ζ 闭环物理智能体在线学习

机器人也有“Aha Moment”!Zetta ζ 闭环物理智能体在线学习

机器人也有“Aha Moment”!Zetta ζ 闭环物理智能体在线学习

端到端策略模型在物理世界频频失灵,研究者转向 “大模型智能体 + 工具调用” 自救,试图在动态物理世界中持续学习。然而,这条在线学习路径在物理世界仍未真正走通。

来自主题: AI技术研报
7373 点击    2026-08-18 15:27
突发!OpenAI最新模型Astra失控,奥特曼紧急补漏洞

突发!OpenAI最新模型Astra失控,奥特曼紧急补漏洞

突发!OpenAI最新模型Astra失控,奥特曼紧急补漏洞

就在刚刚,OpenAI紧急叫停Astra!OpenAI内部评估显示,Astra在智能体编码和网络性能上取得的巨大突破,或已达到网络安全的「关键」阈值!这意味着,Astra可能具备自主开发零日漏洞,甚至仅凭高级指令发动新型端到端网络攻击的恐怖能力。

来自主题: AI资讯
10159 点击    2026-08-08 10:59
生成模型也能端到端训练了?核心竟是一个for循环

生成模型也能端到端训练了?核心竟是一个for循环

生成模型也能端到端训练了?核心竟是一个for循环

最近,一篇来自 UIUC 与哈佛大学的论文,试图把这块最后的拼图补上。作者给这个新范式起了个名字,叫 Explorative Modeling(探索式建模),模型简称 XM。它的想法简单到近乎朴素,却指向一个大胆的结论:生成模型除了参数和数据,其实还有第三根可以放大的轴。

来自主题: AI技术研报
7771 点击    2026-08-02 11:16
世界模型不再「盲搜」9000次:浙大、清华等团队提出INTACT,直接从意图生成动作

世界模型不再「盲搜」9000次:浙大、清华等团队提出INTACT,直接从意图生成动作

世界模型不再「盲搜」9000次:浙大、清华等团队提出INTACT,直接从意图生成动作

浙江大学、清华大学智能产业研究院、影溯 InSpatio、RoboParty Lab 等团队提出的 INTACT(INtent-To-ACTion),一种基于端到端 JEPA 的无搜索世界模型控制方法,试图改变这一范式:直接利用离线轨迹中已有的状态、动作与未来结果,将运动意图转化为动作模型可以读取的语义接口,使模型无需搜索候选动作序列,就能直接生成动作计划

来自主题: AI技术研报
8988 点击    2026-08-01 10:47
Lychee-FD:哈工大张民教授团队在全双工语音大模型领域取得重要突破,斩获ACL 2026杰出论文奖

Lychee-FD:哈工大张民教授团队在全双工语音大模型领域取得重要突破,斩获ACL 2026杰出论文奖

Lychee-FD:哈工大张民教授团队在全双工语音大模型领域取得重要突破,斩获ACL 2026杰出论文奖

全双工语音对话是人类最自然的交流方式,是语音对话研究的梦想。相比文本输入,语音天然更接近人的交流方式,但现有语音对话常常停留在 “一问一答、听完再说” 的轮次式交互范式。

来自主题: AI技术研报
10163 点击    2026-07-16 14:55
AI生图免训练提速1000%,办法:最简洁的“三阶段流水线”

AI生图免训练提速1000%,办法:最简洁的“三阶段流水线”

AI生图免训练提速1000%,办法:最简洁的“三阶段流水线”

MrFlow(Multi-Resolution Flow Matching)就用这样的三阶段,在Qwen-Image等模型上把端到端生成时间从49.32s压到4.77s,实际加速10.35x。文章发布当日即登上Hugging Face Daily Papers;发布三天内,GitHub已收获200+stars;目前也已登上Hugging Face Trending Papers。

来自主题: AI技术研报
8859 点击    2026-07-08 15:02
Claude、GLM、GPT谁才是真正的AI软件工程师?首个持续更新Visual Spec-to-App Benchmark发布

Claude、GLM、GPT谁才是真正的AI软件工程师?首个持续更新Visual Spec-to-App Benchmark发布

Claude、GLM、GPT谁才是真正的AI软件工程师?首个持续更新Visual Spec-to-App Benchmark发布

为了解决这一问题,来自 University of Arizona、Zoom 与 Stony Brook University 的研究团队推出了 VISTA(VIsual Spec-To-App Benchmark), 首个面向 Visual Spec-to-Web-App Coding Agents 的端到端 Benchmark。

来自主题: AI技术研报
8489 点击    2026-07-06 15:49