
4B小模型掀翻大模型牌桌!性能超GPT-3.5,无限长文本性能超Kimi...
4B小模型掀翻大模型牌桌!性能超GPT-3.5,无限长文本性能超Kimi...你敢相信 4B 参数小模型,性能却超越千亿量级的 GPT-3.5 !OpenAI、谷歌、微软、苹果等一众海内外巨头还没做到的事,被一家中国大模型公司抢先了!
来自主题: AI资讯
3104 点击 2024-09-06 15:20
你敢相信 4B 参数小模型,性能却超越千亿量级的 GPT-3.5 !OpenAI、谷歌、微软、苹果等一众海内外巨头还没做到的事,被一家中国大模型公司抢先了!
浏览器里直接能跑的SOTA小模型来了,分别在2亿、5亿和20亿级别获胜,抱抱脸出品。
互相检查,让小模型也能解决大问题。
有CPU就能跑大模型,性能甚至超过NPU/GPU!
今年 6 月底,谷歌开源了 9B、27B 版 Gemma 2 模型系列,并且自亮相以来,27B 版本迅速成为了大模型竞技场 LMSYS Chatbot Arena 中排名最高的开放模型之一,在真实对话任务中比其两倍规模以上的模型表现还要好。
谷歌DeepMind的小模型核弹来了,Gemma 2 2B直接击败了参数大几个数量级的GPT-3.5和Mixtral 8x7B!而同时发布的Gemma Scope,如显微镜一般打破LLM黑箱,让我们看清Gemma 2是如何决策的。
大模型是能力上限,小模型是落地首选
不是大模型用不起,而是小模型更有性价比。
刚刚,GPT-4o mini版迎来“高光时刻”——
大模型迈入“小而强”时代。