AI资讯新闻榜单内容搜索-DeepSeek-R

英伟达下场，首次优化DeepSeek-R1！B200性能狂飙25倍，碾压H100

最近，英伟达开源了首个在Blackwell架构上优化的DeepSeek-R1，实现了推理速度提升25倍，和每token成本降低20倍的惊人成果。同时，DeepSeek连续开源多个英伟达GPU优化项目，共同探索模型性能极限。

来自主题: AI技术研报

12092 点击 2025-02-27 16:33

DeepSeek-R1自写CUDA内核跑分屠榜！斯坦福学霸狂飙GPU编程自动化挑战人类

斯坦福和普林斯顿研究者发现，DeepSeek-R1生成的自定义CUDA内核，完爆了o1和Claude 3.5 Sonnet，拿下总排名第一。虽然目前只能在不到20%任务上超越PyTorch Eager基线，但GPU编程加速自动化的按钮，已经被按下！

来自主题: AI技术研报

12190 点击 2025-02-27 16:17

数据难清洗？试试ThinkJSON奖励算法，让DeepSeek-R1驱动Multi-Agent实现

在实际应用中，我们常常需要模型输出具有严格结构的数据，比如生物制药生产记录、金融交易报告或医疗健康档案等。这种结构化输出的需求在生物制造、金融服务、医疗健康等严格监管的领域尤为重要。

来自主题: AI技术研报

5571 点击 2025-02-27 10:25

速递｜刚刚，DeepSeek又降价了

即日起，北京时间每日00:30-08:30为错峰时段，API 调用价格大幅下调：DeepSeek-V3 降至原价的50%，DeepSeek-R1降至25%，在该时段调用享受更经济更流畅的服务体验。具体价格参看图2.

来自主题: AI资讯

9799 点击 2025-02-26 23:27

500万TPM+20msTPOT，火山引擎用「AI云原生」重构大模型部署范式

部署 DeepSeek 系列模型，尤其是推理模型 DeepSeek-R1，已经成为一股不可忽视的潮流。

来自主题: AI资讯

8477 点击 2025-02-26 14:22

受R1启发，微软亚洲发布Logic-RL，帮助LLM通过RL解决"骑士与骗子"逻辑谜题

本文深入解析一项开创性研究——"Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning"，该研究通过基于规则的强化学习技术显著提升了语言模型的推理能力。微软亚洲的研究团队受DeepSeek-R1成功经验的启发，利用结构化的逻辑谜题作为训练场，为模型创建了一个可以系统学习和改进推理技能的环境。

来自主题: AI技术研报

8362 点击 2025-02-26 09:56