AI资讯新闻榜单内容搜索-模型

英伟达联手MIT清北发布SANA 1.5！线性扩散Transformer再刷文生图新SOTA

SANA 1.5是一种高效可扩展的线性扩散Transformer，针对文本生成图像任务进行了三项创新：高效的模型增长策略、深度剪枝和推理时扩展策略。这些创新不仅大幅降低了训练和推理成本，还在生成质量上达到了最先进的水平。

来自主题: AI技术研报

11991 点击 2025-02-07 16:05

新一代 Kaldi 团队是由 Kaldi 之父、IEEE fellow、小米集团首席语音科学家 Daniel Povey 领衔的团队，专注于开源语音基础引擎研发，从神经网络声学编码器、损失函数、优化器和解码器等各方面重构语音技术链路，旨在提高智能语音任务的准确率和效率。

来自主题: AI技术研报

8194 点击 2025-02-07 16:02

一项非常鼓舞人心的发现是：DeepSeek-R1-Zero 通过纯强化学习（RL）实现了「顿悟」。在那个瞬间，模型学会了自我反思等涌现技能，帮助它进行上下文搜索，从而解决复杂的推理问题。

来自主题: AI技术研报

9262 点击 2025-02-07 15:51

DeepSeek带火知识蒸馏，原作者现身爆料：原来一开始就不受待见。称得上是“蒸馏圣经”、由Hinton、Oriol Vinyals、Jeff Dean三位大佬合写的《Distilling the Knowledge in a Neural Network》，当年被NeurIPS 2014拒收。

来自主题: AI技术研报

8044 点击 2025-02-07 15:43

适应性是自然界最引人注目的现象之一。从章鱼改变皮肤颜色以融入周围环境的方式，到人类大脑在受伤后如何自我重塑，使个体能够恢复失去的功能并适应新的思维或运动方式。生物体表现出适应性，使生命能够在多样化和不断变化的环境中蓬勃发展。

来自主题: AI资讯

9674 点击 2025-02-07 15:34

2025年，软件工程要彻底变天了。先有奥特曼预言，后有微软下场All in智能体。刚刚，首个自主SWE智能体面世，不仅会主动改bug修复错误，还能自主提交PR评论。

来自主题: AI技术研报

7716 点击 2025-02-07 15:30

春节假期后的港股市场迎来结构性行情，以AI大模型为核心的技术革命再次成为资金追逐焦点，这次的落脚点在AI应用的商业化之中。

来自主题: AI资讯

8898 点击 2025-02-07 12:11

今天，我想用一些数据，来盘点2024年各家银行的大模型项目招标结果。

来自主题: AI资讯

8051 点击 2025-02-07 11:26

刚刚，OpenAI把o3-mini的推理思维链公开了。从今日起，免费用户和付费用户都可以看到模型的思维过程，OpenAI终于Open一回。

来自主题: AI资讯

11134 点击 2025-02-07 11:11

成本不到150元，训练出一个媲美DeepSeek-R1和OpenAI o1的推理模型？！这不是洋葱新闻，而是AI教母李飞飞、斯坦福大学、华盛顿大学、艾伦人工智能实验室等携手推出的最新杰作：s1。

来自主题: AI资讯

10002 点击 2025-02-07 00:26