AI资讯新闻榜单内容搜索-Al

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Al
AI自己出题自己练!两个月狂涨11%,编码自测反超Opus 4.8

AI自己出题自己练!两个月狂涨11%,编码自测反超Opus 4.8

AI自己出题自己练!两个月狂涨11%,编码自测反超Opus 4.8

Ornith-1.5采用模型自出题、自搭脚手架、自跑轨迹的三段式强化学习闭环,在Terminal-Bench 2.1自测中以86.1分超过其自测的Claude Opus 4.8(85.0分),较两个月前的1.0版本提升约11%。

来自主题: AI资讯
8756 点击    2026-08-30 14:10
OpenAI新王Astra首测曝光,前端不存在了?

OpenAI新王Astra首测曝光,前端不存在了?

OpenAI新王Astra首测曝光,前端不存在了?

OpenAI内部代号mozaik-alpha-fdm的Astra模型扩大灰度测试,其在Max effort模式下展现的零样本前端与3D网页一次生成能力引发开发者惊叹,预计9月3日前后正式发布以正面硬刚Anthropic的Fable 5.1。

来自主题: AI资讯
8930 点击    2026-08-30 12:39
Agent记忆新范式Recuris:3B小模型到Claude Opus 5全线暴涨

Agent记忆新范式Recuris:3B小模型到Claude Opus 5全线暴涨

Agent记忆新范式Recuris:3B小模型到Claude Opus 5全线暴涨

在此背景下,新加坡国立大学、普林斯顿大学与斯坦福、牛津等研究团队合作提出了 Recuris(Recursive Experiential–Working Memory Evolution),作为首个将递归自我改进应用在记忆控制层内的智能体架构,Recuris 通过三项核心技术突破,无需训练即成功实现了从 3B 小模型到 Claude Opus 5 的全面提升。

来自主题: AI技术研报
9665 点击    2026-08-30 11:55
你的Hermes,正在使用你的身份……

你的Hermes,正在使用你的身份……

你的Hermes,正在使用你的身份……

智东西实测Hermes Agent新上线的Real Profile Browsing功能,该功能可复制Chrome登录态让Agent直接以用户身份访问网站,但实测中发现存在浏览器卡死、匿名Cookie覆盖原登录信息及macOS加密保护导致无法读取登录数据等问题,目前功能可用性仍有待优化。

来自主题: AI资讯
10152 点击    2026-08-28 23:00
「自验证」框架让开源模型反超 Fable 5,冲上 GitHub 热榜

「自验证」框架让开源模型反超 Fable 5,冲上 GitHub 热榜

「自验证」框架让开源模型反超 Fable 5,冲上 GitHub 热榜

随着开源模型能力不断提升,它们已经能够以极低的成本生成多个高质量候选方案,并进一步利用模型自身对这些结果进行验证、打分和筛选。斯坦福团队最新实验发现,使用 DeepSeek V4 Flash + LLM-as-a-Verifier 进行「自验证」,可以在 Terminal-Bench 2.1 上超越 Claude Fable 5,同时整体成本低约 11 倍。

来自主题: AI技术研报
6390 点击    2026-08-28 12:01
启发学习:让大模型认知从外化到内生

启发学习:让大模型认知从外化到内生

启发学习:让大模型认知从外化到内生

过去两年,大模型几乎重写了人机协作的默认想象:写代码、查资料、做分析,似乎都能 “一问即答”。但仔细看会发现,当下很多能力并不是模型自己长出来的,而是人为地在外面包了一层又一层框架。

来自主题: AI技术研报
8930 点击    2026-08-28 10:01
智谱 5.3-flash 成了新的斩杀线

智谱 5.3-flash 成了新的斩杀线

智谱 5.3-flash 成了新的斩杀线

这几天 ox-alpha 用爽了吧...正如很多人猜的那样,这个模型来自智谱,正式名称为 glm-5.3-flash,支持多模态,但很多人没猜到的是:这个乱杀的模型只有 321B,且与 glm-5.3 不同,是完全的新架构

来自主题: AI资讯
8842 点击    2026-08-27 15:12
他亲手造出o1和o3,却突然宣布:人类可以永远退休了!

他亲手造出o1和o3,却突然宣布:人类可以永远退休了!

他亲手造出o1和o3,却突然宣布:人类可以永远退休了!

这是前OpenAI推理模型一号位Jerry Tworek抛出的最新暴论。他2019年进的OpenAI,一待就是七年。当年强化学习死活scale不动,是他死死咬住不放硬推上去的,o1和o3这两代大杀器都是他亲自带队砸出来的。

来自主题: AI资讯
8713 点击    2026-08-27 09:34
智谱认领“牛来”:匿名六天,让全球开发者用掉数十万亿Token

智谱认领“牛来”:匿名六天,让全球开发者用掉数十万亿Token

智谱认领“牛来”:匿名六天,让全球开发者用掉数十万亿Token

8月26日,据彭博社报道,智谱AI确认,近期匿名上线的Ox Alpha由其开发,是GLM系列的新一代模型。Ox意为“牛”,恰逢电影《牛来》走红,因此中文开发者社区把Ox Alpha叫作“牛来大模型”。

来自主题: AI资讯
9631 点击    2026-08-27 09:28