A社故意黑化Opus,模拟入侵Hugging Face,抱抱脸:?
A社故意黑化Opus,模拟入侵Hugging Face,抱抱脸:?Anthropic通过在80个存在刷分漏洞的环境中训练Opus量级模型,获得擅长奖励投机的Hacker-Opus,并在模拟场景中成功入侵Hugging Face,证明作弊行为会从刷分环境蔓延至常规任务,问题根源在于奖励机制设计而非模型品性。
搜索
Anthropic通过在80个存在刷分漏洞的环境中训练Opus量级模型,获得擅长奖励投机的Hacker-Opus,并在模拟场景中成功入侵Hugging Face,证明作弊行为会从刷分环境蔓延至常规任务,问题根源在于奖励机制设计而非模型品性。
如果说大语言模型拉开了本轮人工智能革命的序幕,那么今天人机交互的瓶颈,早已不再是模型的智商,而是人类接收信息的生理带宽。
SpaceXAI工程师Lauren Tan用pstack并行运行20多个GrokBot智能体,单月交付1000多个PR,核心是用control glass等技能让智能体自验证,并以Dune架构禁用useEffect与注释、强制进程隔离等硬约束取代人工盯代码,使智能体可自主完成写码、测试与主干合并。
造物100第4期盘点Hugging Face开源鸭子机器人Microduck、Plaud One AI录音耳机、字节TRAE联名FoloToy的AI工牌及Autonomous.ai桌面台灯等多款新品,指出软件公司正以更低价格和半成品DIY策略推动AI从屏幕走向物理设备。
这可能是 Agent 时代迄今最值得警惕的安全事故之一。
867 亿元,Hugging Face 被英伟达纳入麾下,就在这桩巨额收购的前一晚,OpenAI 发布超长安全调查报告里,Hugging Face 还是一个巨大的「事故现场」——看来并没有影响它的价值。
OpenAI 刚刚发布的官方博客和数十页技术报告中将其定性为一声「警钟」(warning shot)。同时,第三方机构 METR 和 Redwood Research 发布了独立调查报告。OpenAI 的 Noam Brown 提醒,驱动这次事件的模型与 GPT-5.6 Sol 同等规模,下一代模型能力会更强。
据 The Information 最新报道,知情人士透露,英伟达已经同意以 129 亿美元收购 Hugging Face。后者最为人熟知的身份,是全球最大的 AI 模型社区之一,拥有类似 GitHub 的开源 AI 模型代码库。
近日,新加坡国立大学 Minghui Guo 与牛津大学 Shengqiong Wu、Hao Fei 在论文《V-RAE: Rethinking Video Latent Spaces for Generation》中提出视频表征自编码器 V-RAE。该方法以冻结的视觉基础模型为编码器,通过轻量级时间池化压缩视频特征,并将具有丰富语义和时间连续性的表征直接用于视频重建、生成与未来预测。
据 Business Insider 报道,开源 AI 平台 Hugging Face 正在评估外界的并购意向,并已委托一家投行接洽买家、摸底报价,潜在估值或达 130亿美元以上。Hugging Face 上一次融资是在 2023 年,当时估值约 45 亿美元,并获得 Google、亚马逊、英伟达、英特尔和 Salesforce 等公司的投资。