字节系之外,RunningHub突围:顶级AI模型争夺“首发阵地”
字节系之外,RunningHub突围:顶级AI模型争夺“首发阵地”模型的发布流程,早已在密集迭代中演变为精准的工业流水线:技术报告开路,Benchmark榜单刷屏,紧接着开放API,最后以开源权重收尾。
搜索
模型的发布流程,早已在密集迭代中演变为精准的工业流水线:技术报告开路,Benchmark榜单刷屏,紧接着开放API,最后以开源权重收尾。
据一位知情人士透露,Nvidia已就投资Mercor展开讨论。Mercor是一家数据标注服务商,协助这家芯片设计商开发其开源AI模型。此次投资将作为一轮估值200亿美元融资的组成部分。现有投资方General Catalyst已在洽谈领投本轮融资。
8月13日凌晨,DeepSeek V4 Pro正式登场,给开源模型生态又添一把猛火。从Kimi K3到MiniMax H3,再到DeepSeek V4 flash、DeepSeek V4 Pro,在中国开源模型的猛攻之下,美国的AI公司这次是真的坐不住了。
前不久用Fable 5推翻雅可比猜想的Anthropic研究员,又吭哧吭哧和两个人类伙伴带着Claude,做出了668阶哈达玛矩阵!(好数学家不挑AI模型,doge)不过这人每次有成果都不明说,发一堆只有内行才看得懂的东西。
今天,英国《金融时报》援引知情人士报道,字节跳动正在训练一个参数量高达10万亿的AI模型。而这一数字,在昨日晚间的晚点LatePost独家报道中还是“超5万亿”。即使是5万亿,这一模型的规模也已经超过目前中国已发布的最大模型Kimi K3,接近Anthropic的Fable 5;如果是10万亿,那字节的新模型规模将超越约有8万亿参数的Mythos 5。
Transformer 的上限在哪里?这个问题从 2022 年 ChatGPT 问世起,就开始被广泛讨论。
OpenAI宣称下一代AI模型解决了10个世界级难题,其中包括推翻了Connes刚性猜想。
今天,OpenAI重磅放出一份长达62页的「核心手稿」,详细展示了GPT的完整推演。传送门:https://cdn.openai.com/pdf/reasoning-walkthroughs.pdf。它的「摘要」只有一小段,但信息量却大得惊人——这份笔记由AI模型独立撰写,OpenAI团队完全没有插手。
微软周一发布了一款名为Project Perception的新AI安全产品,该产品由微软自主研发、专门针对网络安全任务打造的新一代AI模型驱动。微软将这款产品定位为Anthropic旗下Mythos模型的低成本替代方案,后者同样利用AI模型自动发现软件漏洞。
Gradium 是一家总部位于巴黎、提供语音 AI 模型的初创公司,其对种子轮向包括 NVIDIA 在内的新投资者重新开放后,本轮融资总额现已达 1 亿美元,该公司周四表示 。这家初创公司是从法国 AI 实验室 Kyutai 分拆出来的(该实验室由 Niel 支持)。