AI资讯新闻榜单内容搜索-模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型
一文详解:DeepSeek 第四天开源的模型设计套件

一文详解:DeepSeek 第四天开源的模型设计套件

一文详解:DeepSeek 第四天开源的模型设计套件

第四天,DeepSee发布包括三个主要项目: DualPipe- 一种用于 V3/R1 训练的双向流水线并行算法,实现计算和通信完全重叠; EPLB(Expert Parallelism Load Balancer) - 专为 V3/R1 设计的专家并行负载均衡器; Profile-data- 分析 V3/R1 中计算与通信重叠的性能数据集。

来自主题: AI技术研报
10177 点击    2025-02-27 12:16
DeepSeek今日连开3源!针对优化的并行策略,梁文峰本人参与开发

DeepSeek今日连开3源!针对优化的并行策略,梁文峰本人参与开发

DeepSeek今日连开3源!针对优化的并行策略,梁文峰本人参与开发

按时整活!DeepSeek开源周第四天,直接痛快「1日3连发」,且全都围绕一个主题:优化并行策略。

来自主题: AI技术研报
9270 点击    2025-02-27 11:28
数据难清洗?试试ThinkJSON奖励算法,让DeepSeek-R1驱动Multi-Agent实现

数据难清洗?试试ThinkJSON奖励算法,让DeepSeek-R1驱动Multi-Agent实现

数据难清洗?试试ThinkJSON奖励算法,让DeepSeek-R1驱动Multi-Agent实现

在实际应用中,我们常常需要模型输出具有严格结构的数据,比如生物制药生产记录、金融交易报告或医疗健康档案等。这种结构化输出的需求在生物制造、金融服务、医疗健康等严格监管的领域尤为重要。

来自主题: AI技术研报
4626 点击    2025-02-27 10:25
用完Claude 3.7,我感觉程序员在加速贬值

用完Claude 3.7,我感觉程序员在加速贬值

用完Claude 3.7,我感觉程序员在加速贬值

昨天,Claude 3.7 Sonnet 正式发布。根据目前的各项测评,这个模型可以说是全宇宙最好的代码生成模型,超越了 DeepSeek R1 和 OpenAI 的 o3 等模型。如果你是程序员,一定要第一时间切换过去,用下这款模型。

来自主题: AI资讯
7139 点击    2025-02-27 09:54
杨植麟翻身,还要靠OpenAI

杨植麟翻身,还要靠OpenAI

杨植麟翻身,还要靠OpenAI

Kimi未来还能够翻盘吗? 从公司发展路径上来看,并非没有可能。 作为曾经对OpenAI技术跟随最快的公司,Kimi在去年做出了Kimi探索版、k0-math等多个跟随OpenAI技术的模型,而杨植麟本人也在采访中,表示大模型的未来不仅在于强化学习,还在于多模态能力。 这一点似乎也与OpenAI类似。

来自主题: AI资讯
7926 点击    2025-02-27 09:36
OpenAI早期员工David Luan最新访谈:DeepSeek并未改变AI技术的叙事

OpenAI早期员工David Luan最新访谈:DeepSeek并未改变AI技术的叙事

OpenAI早期员工David Luan最新访谈:DeepSeek并未改变AI技术的叙事

近日,在红点创投(Redpoint Venture)的播客“Unsupervised Learning”上,红点创投合伙人Jacob Effron与David Luan进行了一次访谈。他们从技术视角出发,探讨了DeepSeek给大模型领域的研究和实践带来的启示,并围绕AI模型当下瓶颈的思考和潜在的突破方向做了分享。

来自主题: AI资讯
7535 点击    2025-02-27 09:35
姚班天才创办的大模型公司,卖了

姚班天才创办的大模型公司,卖了

姚班天才创办的大模型公司,卖了

最新消息,斯隆奖得主、姚班校友马腾宇大模型创业成果,被收购! 收购方是MongoDB,一家开源数据库上市龙头。

来自主题: AI资讯
7362 点击    2025-02-26 19:59