开源多模态SOTA再易主,19B模型比肩GPT-4v,16G显存就能跑
开源多模态SOTA再易主,19B模型比肩GPT-4v,16G显存就能跑开源多模态SOTA模型再易主!Hugging Face开发者大使刚刚把王冠交给了CogVLM2,来自大模型创业公司智谱AI。CogVLM2甚至在3项基准测试上超过GPT-4v和Gemini Pro,还不是超过一点,是大幅领先。
搜索
开源多模态SOTA模型再易主!Hugging Face开发者大使刚刚把王冠交给了CogVLM2,来自大模型创业公司智谱AI。CogVLM2甚至在3项基准测试上超过GPT-4v和Gemini Pro,还不是超过一点,是大幅领先。
OpenAI长期霸榜的SuperCLUE(中文大模型测评基准),终于被国产大模型反将一军。
从互联网背景突进AI领域的拓荒者会很像要穿越白垩纪流星撞地球的分割点。
字节豆包低价首秀,让互联网大厂纷纷掀翻大模型地板价。
羊毛出在猪身上? 无论是业务关联性还是定价策略,国内AI大模型市场“会不会像云计算一样,价格战也打了,最后却一地鸡毛”成为新的顾虑和讨论点。
在发布会尾声,OpenAI创始人奥特曼本人登台,预告了下一代模型将会带来新的模态和整体智能。
无论投资界还是产业界,已经没有人质疑AI的兴起是大事件。但无论是谁,奥特曼或者霍夫曼,都无法确定AI领域的投资最终如何获利。
一夜之间,微软的AI全宇宙已经成型。
AI相机,会有“常青树”吗? “ 五一 ” 期间,黏土滤镜在社交网络爆红, 《小羊肖恩》风格 的 “ 黏土靓照 ” ,成了不少人展示自我的新方式 。 这款滤镜最早是来自一款名为Remini的手机AI修图App,生成图片的过程也十分简单,只需下载软件后,打开App首页推荐的“Clay Filter”功能后选择黏土AI特效,再上传图片,Remini就会将照 片其转化为黏土风格。
近年来,「scaling」是计算机视觉研究的主角之一。随着模型尺寸和训练数据规模的增大、学习算法的进步以及正则化和数据增强等技术的广泛应用,通过大规模训练得到的视觉基础网络(如 ImageNet1K/22K 上训得的 Vision Transformer、MAE、DINOv2 等)已在视觉识别、目标检测、语义分割等诸多重要视觉任务上取得了令人惊艳的性能。