世界模型迎来「真考场」:WorldArena 2.0 Challenge正式启动
世界模型迎来「真考场」:WorldArena 2.0 Challenge正式启动WorldArena 1.0 的核心意义,在于将世界模型评测从 “好不好看” 推进到 “是否真的有用”。它不再只关注视频观感,而是把物理一致性、可控性、3D 准确性和具身任务功能性纳入统一评测框架,使许多看似流畅的生成结果第一次在机器人具身任务中接受检验。
搜索
WorldArena 1.0 的核心意义,在于将世界模型评测从 “好不好看” 推进到 “是否真的有用”。它不再只关注视频观感,而是把物理一致性、可控性、3D 准确性和具身任务功能性纳入统一评测框架,使许多看似流畅的生成结果第一次在机器人具身任务中接受检验。
7月14日,旧金山,设计人工智能模型以发现新分子的Chai Discovery宣布完成4亿美元的C轮融资,以进一步加快进展。本轮融资对该公司的估值为38亿美元,由Index Ventures、凯鹏华盈
最近我在给 Codex 折腾一只自己的桌宠。
最新消息终于来了——Gemini 3.5 Pro或将于7月17日正式上线。更有意思的是,这个日期恰好与国产大模型DeepSeek V4正式版的发布窗口正面重合。那么这一次,谷歌拿出的究竟是“真金”还是“虚火”?不妨从三个维度拆解一下。
模型和应用一起做才有足够的壁垒。
一个比Anthropic更好的AI to B故事。
2023年春天,一份来自OpenAI的研究论文让“暴露度”这个词进入公众视野。论文用大语言模型的能力去匹配美国劳工部近千个职业的任务描述,得出一份风险排序:数学家、报税员、量化分析师、作家、网页设计师排在前面,编程与写作技能的暴露度接近100%。
一笔融资进入我们视野——今日(7月13日),趋境科技A轮融资浮出水面,由河南投资集团汇融基金重磅领投,真知资本、尚势资本、星连资本、上海国方创新、弘晖基金、华控基金、杭州福成等老股东继续超额增投。
近年来,多模态大语言模型(MLLM)在视觉问答、图表理解、科学推理等任务上取得了令人瞩目的进展。
今日,彭博亿万富翁指数的最新数据显示,DeepSeek创始人、CEO梁文锋的资产净值已经达到360亿美元(约合人民币2440亿元),超越OpenAI联合创始人兼总裁Greg Brockman,跻身全球最富有的大模型创始人之列。