AI TNT— 让一部分先用AI实现商业化

还能玩纸牌游戏。

来自主题: AI资讯

5827 点击 2024-09-01 11:31

不用打标签，也能解决视觉大模型的偏好对齐问题了。

来自主题: AI技术研报

4816 点击 2024-06-23 20:08

CVPR正在进行中，中国科研力量再次成为场内外焦点之一。

来自主题: AI技术研报

9060 点击 2024-06-20 09:58

与 DeiT 等使用 ViT 和 Vision-Mamba (Vim) 方法的模型相比，ViL 的性能更胜一筹。

来自主题: AI技术研报

7541 点击 2024-06-08 15:55

Transformer 在大模型领域的地位可谓是难以撼动。不过，这个AI 大模型的主流架构在模型规模的扩展和需要处理的序列变长后，局限性也愈发凸显了。Mamba的出现，正在强力改变着这一切。它优秀的性能立刻引爆了AI圈。

来自主题: AI技术研报

6620 点击 2024-01-22 14:43

训完130亿参数通用视觉语言大模型，只需3天！北大和中山大学团队又出招了——在最新研究中，研究团队提出了一种构建统一的图片和视频表征的框架。利用这种框架，可以大大减少VLM（视觉语言大模型）在训练和推理过程中的开销。

来自主题: AI资讯

5606 点击 2023-11-29 15:32

AI能理解搞笑视频笑点在哪里了。北大等团队开源视觉语言大模型Video-LLaVA，将图像和视频表示对齐到统一的视觉特征空间，在13个图片和视频基准上达到先进的性能。

来自主题: AI技术研报

4583 点击 2023-11-21 12:24