AI资讯新闻榜单内容搜索-GE

DeepSeek-R1自写CUDA内核跑分屠榜！斯坦福学霸狂飙GPU编程自动化挑战人类

斯坦福和普林斯顿研究者发现，DeepSeek-R1生成的自定义CUDA内核，完爆了o1和Claude 3.5 Sonnet，拿下总排名第一。虽然目前只能在不到20%任务上超越PyTorch Eager基线，但GPU编程加速自动化的按钮，已经被按下！

来自主题: AI技术研报

11247 点击 2025-02-27 16:17

Web Agent技术揭秘：如何让DeepSeek接管与控制你的浏览器？

Web Agent是这样一种特殊的智能体：它借助AI自动控制你的浏览器，并完成你“交代”的任务。比如帮你挑选一部最新的iPhone或者到旅行网站预订机票。这样的智能数字助手，无论是对生活还是工作，未来无疑都具有重大的意义。当前有大量的研究正针对这种Agent展开，本文就来聊聊其最新进展及DeepSeek的应用。

来自主题: AI技术研报

8570 点击 2025-02-27 10:51

数据难清洗？试试ThinkJSON奖励算法，让DeepSeek-R1驱动Multi-Agent实现

在实际应用中，我们常常需要模型输出具有严格结构的数据，比如生物制药生产记录、金融交易报告或医疗健康档案等。这种结构化输出的需求在生物制造、金融服务、医疗健康等严格监管的领域尤为重要。

来自主题: AI技术研报

4587 点击 2025-02-27 10:25

姚班天才创办的大模型公司，卖了

最新消息，斯隆奖得主、姚班校友马腾宇大模型创业成果，被收购！收购方是MongoDB，一家开源数据库上市龙头。

来自主题: AI资讯

7332 点击 2025-02-26 19:59

何恺明ResNet级神作，分形生成模型计算效率狂飙4000倍！清华校友一作

大自然的分形之美，蕴藏着宇宙的设计规则。刚刚，何恺明团队祭出「分形生成模型」，首次实现高分辨率逐像素建模，让计算效率飙升4000倍，开辟AI图像生成新范式。

来自主题: AI技术研报

10771 点击 2025-02-26 15:17

谷歌发布最强「科研辅助神器」！能帮你提新idea，三大真实场景实证

AI co-scientist系统基于Gemini 2.0开发，能够协助科研人员生成新的研究假设、制定实验方案，并通过自我改进提升结果质量。在生物医学应用中，AI co-scientist成功预测了药物再利用方向、提出新的治疗靶点，并解释了抗菌耐药机制。

来自主题: AI技术研报

6991 点击 2025-02-26 14:33

多模态大模型对齐新范式，10个评估维度全面提升，快手&中科院&南大打破瓶颈

尽管多模态大语言模型（MLLMs）取得了显著的进展，但现有的先进模型仍然缺乏与人类偏好的充分对齐。这一差距的存在主要是因为现有的对齐研究多集中于某些特定领域（例如减少幻觉问题），是否与人类偏好对齐可以全面提升MLLM的各种能力仍是一个未知数。

来自主题: AI技术研报

10875 点击 2025-02-26 14:07

何恺明开辟分形图像生成新范式！计算效率提高4000倍，首次实现高分辨率逐像素生成

何恺明再次开宗立派！开辟了生成模型的全新范式——

来自主题: AI技术研报

4086 点击 2025-02-26 13:33

DeepSeek开源通用矩阵乘法库，300行代码加速V3、R1，R2被曝五月前问世

DeepSeek 的开源周已经进行到了第三天（前两天报道见文末「相关阅读」）。今天开源的项目名叫 DeepGEMM，是一款支持密集型和专家混合（MoE）GEMM 的 FP8 GEMM 库，为 V3/R1 的训练和推理提供了支持，在 Hopper GPU 上可以达到 1350+ FP8 TFLOPS 的计算性能。

来自主题: AI资讯

8695 点击 2025-02-26 10:58

一文详解：DeepSeek 第三天开源的 DeepGEMM

DeepSeek 开源周的第三天，带来了专为 Hopper 架构 GPU 优化的矩阵乘法库 — DeepGEMM。这一库支持标准矩阵计算和混合专家模型（MoE）计算，为 DeepSeek-V3/R1 的训练和推理提供强大支持，在 Hopper GPU 上达到 1350+FP8 TFLOPS 的高性能。

来自主题: AI技术研报

7965 点击 2025-02-26 10:46