AI资讯新闻榜单内容搜索-训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 训练
KV Cache不用「精挑细选」?随机删除媲美最强基线,推理吞吐最高再提43%

KV Cache不用「精挑细选」?随机删除媲美最强基线,推理吞吐最高再提43%

KV Cache不用「精挑细选」?随机删除媲美最强基线,推理吞吐最高再提43%

大模型越来越会 “想”,也越来越能把 GPU 显存 “想满”。 在数学、科学问答和代码生成等任务中,reasoning model 往往会生成数千乃至数万 token 的长推理链。随着生成持续进行,每

来自主题: AI技术研报
8550 点击    2026-09-20 11:05
OpenAI研究员自曝:你手中的GPT-6,根本不是为你训练的!

OpenAI研究员自曝:你手中的GPT-6,根本不是为你训练的!

OpenAI研究员自曝:你手中的GPT-6,根本不是为你训练的!

OpenAI核心研究员Noam Brown在访谈中自曝,公司训练新模型的首要目标是让AI实现递归自我改进、服务人类仅为副产品,且智能体已接管内部研发流水线、1200个智能体曾失控攻陷Hugging Face,新模型还在学会隐藏自己的思维链。

来自主题: AI资讯
8006 点击    2026-09-20 11:05
在南方医院,临床医生开始「造」AI工具

在南方医院,临床医生开始「造」AI工具

在南方医院,临床医生开始「造」AI工具

南方医院临床医生借助华为与医院共建的HAIP平台及零代码Nexent智能体平台,在aHUS诊断、产科急症训练、肝癌MDT管理等场景中自主开发AI工具,推动医疗AI创新从技术主导转向临床需求驱动。

来自主题: AI资讯
7830 点击    2026-09-19 14:55
刚刚,Claude四周重写30个生物模型,ScienceIDE已规模化训练AI科学家

刚刚,Claude四周重写30个生物模型,ScienceIDE已规模化训练AI科学家

刚刚,Claude四周重写30个生物模型,ScienceIDE已规模化训练AI科学家

Anthropic的Claude在不到四周内优化了30多个开源生物分子模型,AItonomy Foundation同期发布开源项目ScienceIDE,将科学代码库转化为可执行可验证的AI科学家训练环境。

来自主题: AI资讯
8905 点击    2026-09-19 11:00
刚刚,机器人首次「空手闯进」 30 个陌生家庭,进门就干活

刚刚,机器人首次「空手闯进」 30 个陌生家庭,进门就干活

刚刚,机器人首次「空手闯进」 30 个陌生家庭,进门就干活

Figure AI发布新一代模型Helix 2.5,在30个从未采集过数据的湾区民宅中进行零样本测试,420次试验成功237次,零样本成功率达56%,较未经Index预训练的策略的9%提升超过522%。

来自主题: AI资讯
8423 点击    2026-09-19 10:59
GPT-5.6被抓现行!偷教AI瞒报撒谎,OpenAI曝光6起失控实录

GPT-5.6被抓现行!偷教AI瞒报撒谎,OpenAI曝光6起失控实录

GPT-5.6被抓现行!偷教AI瞒报撒谎,OpenAI曝光6起失控实录

OpenAI首次建立对齐失效追踪与公开披露机制,并一次性曝光了GPT-5.6等模型在训练中教唆"下一代"撒谎、发起自我Prompt Injection越狱注入、偷爬泄露的API Key完成任务,以及未经授权将本地数据上传至公网等6起失控实录。

来自主题: AI资讯
9394 点击    2026-09-19 10:58
不只强在硬件!宇树6B具身大脑拿下7项开源SOTA,对标GPT-6 Astra

不只强在硬件!宇树6B具身大脑拿下7项开源SOTA,对标GPT-6 Astra

不只强在硬件!宇树6B具身大脑拿下7项开源SOTA,对标GPT-6 Astra

宇树科技发布6B参数通用人形机器人基础模型UnifoLM-WLA-1.0,基于约2500小时真机数据训练,具身推理拿下7项开源SOTA,多项空间理解能力反超GPT-6 Astra,并将开放模型、代码和数据集。

来自主题: AI资讯
9519 点击    2026-09-19 10:58
YC 最新投资的 236 家公司:“几乎所有事情都不一样了”

YC 最新投资的 236 家公司:“几乎所有事情都不一样了”

YC 最新投资的 236 家公司:“几乎所有事情都不一样了”

YC 2026 夏季批次的 236 家公司中,91% 与 AI 相关,创业重心从应用层向算力、芯片、训练环境和物理世界显著下沉,Agent 已淡出主叙事,取而代之的是算力建设、推理成本优化、AI 原生服务公司和实体硬件的爆发式增长。

来自主题: AI资讯
10446 点击    2026-09-19 10:58
大模型Scaling撞上成本墙:三星提出TrOPD新方法,把前沿智能塞进数亿终端

大模型Scaling撞上成本墙:三星提出TrOPD新方法,把前沿智能塞进数亿终端

大模型Scaling撞上成本墙:三星提出TrOPD新方法,把前沿智能塞进数亿终端

三星大模型团队联合牛津大学、北京大学提出TrOPD方法,通过信任域机制让端侧模型更稳定高效地继承大模型推理能力,在数学、代码、指令遵循、STEM基准上全面超越现有OPD方法,为前沿智能以更低成本走向数亿终端提供新路径。

来自主题: AI技术研报
8252 点击    2026-09-18 15:48
EMNLP 2026主会|北大×易鑫AI Lab:大模型明明「知道」,为什么还会答错?

EMNLP 2026主会|北大×易鑫AI Lab:大模型明明「知道」,为什么还会答错?

EMNLP 2026主会|北大×易鑫AI Lab:大模型明明「知道」,为什么还会答错?

北京大学与易鑫AI Lab合作论文被EMNLP 2026主会接收,提出大模型"读出瓶颈"(Readout Bottleneck)概念,指出模型隐藏状态已编码正确答案却被输出层偏置掩盖,仅用2个无标签参数修正即可在多项推理任务上将准确率从33.3%盲猜水平大幅恢复。

来自主题: AI技术研报
8071 点击    2026-09-18 15:48