新注意力让大模型上下文内存占用砍半!精度不减还能加速2倍
新注意力让大模型上下文内存占用砍半!精度不减还能加速2倍大模型同样的上下文窗口,只需一半内存就能实现,而且精度无损? 前苹果ASIC架构师Nils Graef,和一名UC伯克利在读本科生一起提出了新的注意力机制Slim Attention。
搜索
大模型同样的上下文窗口,只需一半内存就能实现,而且精度无损? 前苹果ASIC架构师Nils Graef,和一名UC伯克利在读本科生一起提出了新的注意力机制Slim Attention。
肝癌是全球癌症相关死亡的第三大原因,手术切除后的复发率高达70%,如何准确预测肿瘤手术切除后复发风险是一个难题。
HuixiangDou 是群聊场景的 LLM 知识助手。
角色扮演 AI(Role-Playing Language Agents,RPLAs)作为大语言模型(LLM)的重要应用,近年来获得了广泛关注。
最近一段时间,智能体(Agent)再次成为 AI 领域热议的焦点。
灵活到像 CG,官方却说是一倍速实拍,国产机器人又整活了。
AI热潮将彻底颠覆编程行业。OpenAI首席产品官Kevin Weil抛出惊人预测,2025年,AI在编程领域将永远超越人类。这不仅仅是一个大胆的预测,更是一个时代拐点的宣告。
长文本任务是当下大模型研究的重点之一。在实际场景和应用中,普遍存在大量长序列(文本、语音、视频等),有些甚至长达百万级 tokens。
文心一言两周年,百度一口气上新两款模型,并且上来就是一个主题:免费。
36氪获悉,近日人形机器人公司松延动力北京科技有限公司(以下简称「松延动力」)完成连续两轮过亿元A轮及A+轮融资。A+轮由彬复领投,华强资本跟投;A轮投资方包括神骐资本、北京未来科学城基金、天启资本、泽然资本、教育科技集团战略方等机构。