大模型终于说不出脏话了!有毒子词剪枝ToxPrune,预训练+推理双重防线
大模型终于说不出脏话了!有毒子词剪枝ToxPrune,预训练+推理双重防线不用训练,不改权重,只动词表就能给大模型“消毒”?
搜索
不用训练,不改权重,只动词表就能给大模型“消毒”?
故事是这样的。 这个端午节在家,终于可以休息了,然后几乎就是疯狂的用Agent来做自己好玩的东西。
Google DeepMind在6月份对外分享了DiffusionGemma的技术报告,明确指向了一条与现有主流完全不同的演进道路。当大家都在绞尽脑汁让大模型逐词吐字的速度变快时,谷歌干脆把生成顺序改了。
英伟达不造机器人,但要帮具身企业造好机器人(doge)
机器人模型已经能根据“把杯子放进篮子”这类指令完成任务,但用哪只手?
周末,codex一个大bug爆了。在流式传输和自动化任务的时候,以5M/s的速度,持续往磁盘写日志。 每年大概要写640TB。要不了一年,就可以耗尽部分消费级SSD标的写入寿命。
米哈游的新项目《BSide: Olivia Lin》,看起来不太像一款传统游戏。
你以为自己在薅AI羊毛?OpenAI和Anthropic却在笑看账本。200美元的个人订阅,根本不是在卖服务,而是在批量培养「病毒式销售员」。
做了一年 Agent 基础设施,踩了无数坑,我终于想明白了一件事:好的 Agent 架构不是把所有功能塞进一个进程,而是让每一层都能独立演化。
有人欢呼,这是OpenAI「最开放」的一次。给Codex装上能随便换模型的插座,等于亲手填平自己模型的护城河。它图什么?