新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
AITNT-国内领先的一站式人工智能新闻资讯网站 搜索
新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练
7617点击    2025-03-25 22:30

刚刚,DeepSeek官方发布DeepSeek-V3模型更新技术报告。


V3新版本在数学、代码类相关评测集成绩超过GPT-4.5


新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练


而且这只是通过改进后训练方法实现


DeepSeek-V3-0324和之前的DeepSeek-V3使用同样的base模型


打破了之前传言该版本base模型是R2的传言。


新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练


新版本参数量约为660B,与此前网传的685B有所出入。


开源版本上下文长度为128K(网页端、App和API提供 64K 上下文)。


私有化部署时只需要更新checkpoint和tokenizer_config.json(tool calls相关变动)。


目前,想要体验这一版本模型,只需用户登录官方网页、APP、小程序进入对话界面后,关闭深度思考即可体验。API 接口和使用方式保持不变。


官方建议,此后非复杂推理任务使用V3新版本更好。


此外,官方还进一步展示了新版本在各个维度的能力。


前端开发


生成代码可用性更高,视觉效果也更好。


新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练


中文写作


相较于R1版有进一步优化,特别提升了中长篇的内容质量。


比如写一篇关于苏轼生平的散文:


新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练


中文搜索


联网情况下,V3新版本的搜索输出内容也更详实准确、排版更清晰美观。


现在写一份3000字的市场报告也是so easy(上下滑动查看完整内容):


新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练

此外,V3新版本在工具调用、角色扮演、问答闲聊等方面也进一步提升。


今天白天不少网友也上手实测了诸多能力,比如做个小游戏:


新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练


该版本模型采用宽松的MIT开源协议。


且可直接部署在M3 Ultra的Mac Studio上。


这意味着大模型开发应用的门槛更进一步降低。


新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练



话不多说,趁着深夜,还没睡的赶紧去体验最新版吧~


参考链接: https://mp.weixin.qq.com/s/XK6ymJL7y0vo_GQXxmpuBA



文章来自微信公众号 “ 量子位 ”,作者 明敏


新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练



关键词: DeepSeek-V3 , GPT-4.5 , AI , deepseek
AITNT-国内领先的一站式人工智能新闻资讯网站
AITNT资源拓展
根据文章内容,系统为您匹配了更有价值的资源信息。内容由AI生成,仅供参考
1
cursor

【免费】cursor-auto-free是一个能够让你无限免费使用cursor的项目。该项目通过cloudflare进行托管实现,请参考教程进行配置。

视频教程:https://www.bilibili.com/video/BV1WTKge6E7u/

项目地址:https://github.com/chengazhen/cursor-auto-free?tab=readme-ov-file