AI资讯新闻榜单内容搜索-多模态

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 多模态
Physical AI正进入经验工程时代,Ropedia聚焦全链路数据基建,完成数千万美元融资

Physical AI正进入经验工程时代,Ropedia聚焦全链路数据基建,完成数千万美元融资

Physical AI正进入经验工程时代,Ropedia聚焦全链路数据基建,完成数千万美元融资

天使轮由一线美元基金,智能制造与大模型产业方共同领投;数据集 Xperience-10M 位列全平台数据集榜第 2 名,具身赛道第一名,目前已被多款具身基础模型 Qwen-VLA、MolmoMotion 等采用;多模态采集系统 HOMIE 进入规模化量产交付,新一代系统将于 2026 年 8 月发布。

来自主题: AI资讯
10311 点击    2026-08-06 15:42
国内唯一做多模态长记忆的公司,丘脑智能完成千万融资

国内唯一做多模态长记忆的公司,丘脑智能完成千万融资

国内唯一做多模态长记忆的公司,丘脑智能完成千万融资

国内唯一做多模态长记忆的公司——丘脑智能,推出原生多模态记忆基座,押注AI从通用走向个性化,最终走向主动智能。

来自主题: AI资讯
10315 点击    2026-08-06 10:40
梁文锋的「最终」,杨植麟的「现在」

梁文锋的「最终」,杨植麟的「现在」

梁文锋的「最终」,杨植麟的「现在」

Coding之外, 关于原生多模态的争论从未停止。

来自主题: AI资讯
7373 点击    2026-08-05 15:14
北大等联合发布Data Pyramid:用五层数据金字塔系统回答「机器人应该从什么数据中学习?」

北大等联合发布Data Pyramid:用五层数据金字塔系统回答「机器人应该从什么数据中学习?」

北大等联合发布Data Pyramid:用五层数据金字塔系统回答「机器人应该从什么数据中学习?」

多模态基础模型可以通过互联网规模的图像与语言学习「看」和「说」,但具身智能没有同样的捷径。机器人必须进一步理解物理状态与动力学,判断动作如何改变环境,并在真实世界中执行连续行为;这要求训练数据同时连接观察、状态、动作与物理后果。

来自主题: AI技术研报
6303 点击    2026-08-05 10:30
全世界最强的AI,都在“抄”这群普通人的作业

全世界最强的AI,都在“抄”这群普通人的作业

全世界最强的AI,都在“抄”这群普通人的作业

这两天,AI圈百家争鸣。GPT-6曝光、DeepSeek V4 Flash公测、SD2.5发布、MiniMax多模态开源视频模型发布……

来自主题: AI资讯
10393 点击    2026-08-03 11:01
JarvisHub:让创作Agent走出聊天框——面向长程多模态创作的开源画布原生Harness

JarvisHub:让创作Agent走出聊天框——面向长程多模态创作的开源画布原生Harness

JarvisHub:让创作Agent走出聊天框——面向长程多模态创作的开源画布原生Harness

JarvisHub 给出的答案,是把可编辑画布同时变成用户工作区、Agent 的外部记忆、行动空间和共享项目状态。Agent 不再只从聊天记录里猜测上下文,而是直接「看」到画布上的提示词、参考图、候选版本、生成结果、依赖关系、失败记录和用户反馈,再据此规划、调用工具、写回结果。

来自主题: AI资讯
8756 点击    2026-08-02 11:09
只读文本的AI,科学推理能力只有“看图”AI的1/3丨中科大

只读文本的AI,科学推理能力只有“看图”AI的1/3丨中科大

只读文本的AI,科学推理能力只有“看图”AI的1/3丨中科大

目前,这项技术已成功应用于上海人工智能实验室Intern-S2-Preview 35B/397B系列多模态大模型的预训练中,有效提升了模型的科学推理与多模态理解能力。值得一提的是,相关研发均基于国产昇腾算力平台完成,并成功实现了面向大规模预训练的深度适配与优化。

来自主题: AI技术研报
8266 点击    2026-08-01 10:45
翁荔刚回OpenAI,Thinking Machines反手发布新模型Inkling-Small

翁荔刚回OpenAI,Thinking Machines反手发布新模型Inkling-Small

翁荔刚回OpenAI,Thinking Machines反手发布新模型Inkling-Small

今天,Thinking Machines正式发布第二款重磅模型——Inkling-Small。276B总参数、12B激活参数,原生多模态,100万token上下文。半个月前,首个开源975B Inkling登场,曾在AI圈掀起了巨浪。

来自主题: AI资讯
8960 点击    2026-07-31 13:35
MiniMax H3:打破任务和模态边界的开放模型

MiniMax H3:打破任务和模态边界的开放模型

MiniMax H3:打破任务和模态边界的开放模型

今天,我们正式发布 MiniMax H3。这是一款通用的全模态生成模型,支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的音视频,最高可支持 15s 2K 分辨率。

来自主题: AI资讯
6072 点击    2026-07-31 11:14