AI资讯新闻榜单内容搜索-大模型推理

中国团队首次夺魁！无问芯穹FlightVGM获FPGA'25最佳论文，峰值算力超GPU21倍

国际可重构计算领域顶级会议 ——FPGA 2025 在落幕之时传来消息，今年的最佳论文颁发给了无问芯穹和上交、清华共同提出的视频生成大模型推理 IP 工作 FlightVGM，这是 FPGA 会议首次将该奖项授予完全由中国大陆科研团队主导的研究工作，同时也是亚太国家团队首次获此殊荣。

来自主题: AI资讯

10008 点击 2025-03-03 10:45

用代码训练大模型思考，其他方面的推理能力也能提升。

来自主题: AI技术研报

5590 点击 2025-02-18 10:40

Falcon 方法是一种增强半自回归投机解码框架，旨在增强 draft model 的并行性和输出质量，以有效提升大模型的推理速度。Falcon 可以实现约 2.91-3.51 倍的加速比，在多种数据集上获得了很好的结果，并已应用到翼支付多个实际业务中。

来自主题: AI技术研报

7521 点击 2025-01-08 14:38

大模型的的发布固然令人欣喜，但是各类测评也是忙坏了众多 AI 工作者。大模型推理的幻觉问题向来是 AI 测评的重灾区，诸如 9.9>9.11 的经典幻觉问题，各大厂家恨不得直接把问题用 if-else 写进来。

来自主题: AI技术研报

8540 点击 2024-12-30 10:39

o1不是通向大模型推理的唯一路径！ MIT的新研究发现，在测试时对大模型进行训练，可以让推理水平大幅提升。

来自主题: AI技术研报

3607 点击 2024-11-12 13:17

改进KV缓存压缩，大模型推理显存瓶颈迎来新突破—— 中科大研究团队提出Ada-KV，通过自适应预算分配算法来优化KV缓存的驱逐过程，以提高推理效率。

来自主题: AI技术研报

4769 点击 2024-11-02 19:10

PPIO推出新AI产品，助力分布式云计算及AIGC应用。

来自主题: AI资讯

7472 点击 2024-09-05 15:13

KV Cache 是大模型推理性能优化的一个常用技术，该技术可以在不影响任何计算精度的前提下，通过空间换时间的思想，提高推理性能。

来自主题: AI资讯

8599 点击 2024-09-03 10:46

2024年，落地，无疑是大模型最重要的主题。

来自主题: AI资讯

11938 点击 2024-08-20 16:31

千亿参数规模的大模型推理，服务器仅用4颗CPU就能实现！

来自主题: AI资讯

7577 点击 2024-08-01 15:35