不靠 CFG、DMD、GAN、Drifting 和MeanFlow,如何训练一步生成模型?
不靠 CFG、DMD、GAN、Drifting 和MeanFlow,如何训练一步生成模型?只做一次生成器前向,就能得到一张图,这是一步生成追求的效率。但想把采样步数降到 1,难题其实在训练端:怎样用足够稳定、简单的监督信号,让生成分布靠近真实分布?
搜索
只做一次生成器前向,就能得到一张图,这是一步生成追求的效率。但想把采样步数降到 1,难题其实在训练端:怎样用足够稳定、简单的监督信号,让生成分布靠近真实分布?
「欢迎来Anthropic上班!」
MiniMax 在发布说明里直接用了两个词:Rebuilt on Pi Agent,基于开源 Pi Agent 框架重构;宣传图上写得更干脆,Rebuilt from the Core,从核心重建。对 Node.js 开发者来说,这件事比又一款 AI 编程工具上线更有意思。
“蒸馏”一词再次成为舆论的关注焦点。这一次,站在聚光灯下的不是多次指控国产模型蒸馏的强硬派Anthropic,而是久未公开露面的张一鸣。张一鸣在最近的字节全员会上罕见发话:字节宁愿忍受模型的落后,也不希望依赖蒸馏实现短时的智能爬坡。
AI实验室Mirendil已与Google Cloud签署一项多年期合作协议,为其自我改进型AI研究获取算力资源。这笔交易折射出当前塑造AI行业格局的两大趋势:云计算巨头正以巨额基础设施承诺争夺初创公司客户,而AI公司则在扩张过程中争相锁定尽可能多的算力协议,以确保资源供给。
今天,英国《金融时报》援引知情人士报道,字节跳动正在训练一个参数量高达10万亿的AI模型。而这一数字,在昨日晚间的晚点LatePost独家报道中还是“超5万亿”。即使是5万亿,这一模型的规模也已经超过目前中国已发布的最大模型Kimi K3,接近Anthropic的Fable 5;如果是10万亿,那字节的新模型规模将超越约有8万亿参数的Mythos 5。
AI圈六家巨头,罕见地坐上了同一张桌子。8月6日,一份名为Agent Plugins 1.0.0的开放规范正式公开。它干的是一件无数AI开发者盼了很久的实事:给AI智能体的插件,定一个统一的「包装盒」,从此一份包走天下,不用再为每家客户端重复打包。
近日,浙江大学 OmniAI 团队在 《Show, Don’t Tell: Evaluating Spatial Cognition in Generative Pixels Rather Than LLM Text》 中提出 ProVisE,让图像生成模型直接在图中回答空间问题,并将视觉答案还原为原 benchmark 可以评分的结构化预测。
最近,有人注意到,Anthropic 在招聘一个名为「内部风险调查员」的角色,该角色的要求是「具备人类和技术调查方面的专业知识,以支持和保护 Anthropic 的使命…… 威慑、识别、调查和缓解对 Anthropic 最关键资产的风险,包括人员、数据和基础设施……」
DeepSeek API要整体涨价了,预计涨幅较大。消息一出,梁文锋恢复不久的“梁圣”称号,又被互联网当场褫夺,贬回“梁子”。从“梁圣”“梁叔”到“梁子”“牢梁”,梁文锋的风评如同一只滑动变阻器,在不同刻度间反复游移,也让他成为中国AI圈最活跃的人形meme之一。