珀乐互动完成天使轮融资,以AI+IP重塑数字内容生态 | 首发
珀乐互动完成天使轮融资,以AI+IP重塑数字内容生态 | 首发36氪获悉,以AI为核心的数字内容公司珀乐互动科技(下称“珀乐互动”)已完成天使轮融资,金额为数千万元人民币。本轮投资由星连资本领投、春华创投跟投,资金将重点用于技术研发、团队扩充与IP商业化开发,全面加速公司多模态泛娱乐生态的战略布局。
搜索
36氪获悉,以AI为核心的数字内容公司珀乐互动科技(下称“珀乐互动”)已完成天使轮融资,金额为数千万元人民币。本轮投资由星连资本领投、春华创投跟投,资金将重点用于技术研发、团队扩充与IP商业化开发,全面加速公司多模态泛娱乐生态的战略布局。
随着多模态大语言模型(MLLM)支持更长上下文,高分辨率图像和长视频会产生远多于文本的视觉 Token,在自注意力二次复杂度下迅速成为效率瓶颈。
开源多模态生成领域,迎来架构级的底层突破。
一张蓝锥嘴雀的图片,你能认出它是“鸟”,但能认出它是“鸟纲-雀形目-唐纳雀科-锥嘴雀属-蓝锥嘴雀”吗?
多模态大模型,到底有多“嘴硬”? 浙江大学联合阿里巴巴、香港城市大
今天,机器之心获悉,腾讯 TEG 技术工程事业群组织架构发生了部分调整,AI Lab 被撤销,蒋杰不再担任 AI Lab 主任,但其他管理职责不变。此次调整过后,原 AI Lab 部分人员调整至混元团队向姚顺雨汇报。产学研合作中心保留。多模态部负责人向 TEG 总裁卢山汇报。
打破多模态视觉+语言拼接套路!
统一多模态生成编辑模型,正在走向“重器化”
多模态模型代码写得像老司机,却在数手指、量柱子时频频翻车?UniPat AI用五百行代码打造的SWE-Vision,让模型「掏出Python尺子」自我验证,一举拿下五大视觉相关基准SOTA。
Google 最近发了 Gemini Embedding 2,他们第一个原生多模态向量模型。文本、图像、视频、音频、文档,全部映射到同一个 3072 维向量空间。这是 Omni Embedding(全模态向量模型)的大趋势:一个架构吃下所有模态,从 jina-embeddings-v4 到 Omni-Embed-Nemotron 再到 Omni-5,大家都在往这个方向收敛。