PEFT方法评测不能只看下游分:通用能力损失也该被量化
PEFT方法评测不能只看下游分:通用能力损失也该被量化近期,来自香港中文大学、西湖大学、德国马普所等机构的研究者提出了 PEFT-Arena —— 一个从稳定性‑可塑性权衡(stability–plasticity trade-off)视角重新审视 PEFT 方法的评测基准与分析框架。该工作已在 ICLR 2026 相关 workshop 上进行了展示,并开源了完整代码。
搜索
近期,来自香港中文大学、西湖大学、德国马普所等机构的研究者提出了 PEFT-Arena —— 一个从稳定性‑可塑性权衡(stability–plasticity trade-off)视角重新审视 PEFT 方法的评测基准与分析框架。该工作已在 ICLR 2026 相关 workshop 上进行了展示,并开源了完整代码。
谷歌DeepMind宣布:AGI,已经过时了!就在最近,谷歌DeepMind出了一份干货满满的57页报告,标题只有四个词:《从AGI到ASI》。论文地址:https://arxiv.org/abs/2606.12683
最近整个世界的魔幻程度,真的让人唏嘘。 今天早上,Anthropic收到了美国商务部的一封信。 信的内容很简单,以国家安全为由,要求Anthropic立刻暂停所有外国公民对Fable 5和Mythos
GLM-5.2 是智谱迄今能力最强的开源模型,支持真正可用的 1M 上下文,并在长程任务中继续保持领先。它也依旧是我们心中最强的国产 Coding 模型。
今天,由李飞飞联合创立的空间智能公司 World Labs 在同一天发布了三篇技术论文!三篇论文分别由公司内部实习生主导完成,研究方向各异,但共享同一个核心命题:借助已在海量图片数据上训练成熟的 2D 生成模型,降低 3D 内容生成的难度门槛。
就在刚刚,Anthropic官宣——全球禁用外籍人士对Claude Fable 5和Mythos 5的所有访问权限。无论是在美国境内还是境外,就连Anthropic的外籍员工,全都不可用。上线才3天的Claude Fable 5,一瞬间就没了。
主打高端直播 / 会议高清摄像头的Opal Camera在卖了超 5 万台设备后2025 年正式更名 Opal Electronics(以下简称Opal ),转型全品类 AI 消费硬件。随后OpenAI 领投4000 万美元,投资方含三星、Peter Thiel 基金、MKBHD(知名数码博主),投后估值2.75 亿美元。
2026年6月,个人AI助手Town完成5500万美元A轮融资,由a16z领投,Forerunner、First Round、Conviction等机构跟投。在Agent赛道高度拥挤的背景下,这笔融资释放了一个明确信号
刚刚,UC伯克利放出了一场号称“智能体最后的考试”的全新基准测试。它把当今最强的AI Agent们拉到考场上,让它们干真正的活——在Siemens NX里建3D模型、在Unreal Engine里搭游戏场景、在Adobe After Effects里做特效合成。
所以,教你一招把Claude code塞进Codex里。所以我现在的工位长这样——左边是 GPT,右边跑着 Claude Code,同一个窗口。Codex负责管规划、把控进度,Claude code负责干活;Fable 拒答降级的时候,直接复制上下文丢给左边的GPT接住,无缝换人。