AI资讯新闻榜单内容搜索-DeepSWE

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: DeepSWE
刚刚,DeepSeek-V4多模态模型开源

刚刚,DeepSeek-V4多模态模型开源

刚刚,DeepSeek-V4多模态模型开源

DeepSeek-V4-Flash-Vision-Exp多模态模型正式开源,该模型为DeepSeek-V4系列首个实验性多模态模型,基于DeepSeek-V4-Flash架构集成视觉模块,在真实世界软件工程测试DeepSWE中以59.3%反超Opus-4.8登顶,并在零样本视觉推理测试ZeroBench中击败Opus-4.8。

来自主题: AI资讯
8941 点击    2026-08-31 21:53
刚刚,Qwen3.8-Flash震撼发布,我们看到了Qwen4的骨架

刚刚,Qwen3.8-Flash震撼发布,我们看到了Qwen4的骨架

刚刚,Qwen3.8-Flash震撼发布,我们看到了Qwen4的骨架

就在刚刚,阿里交出了一份让人满意的答卷:发布了 Qwen3.8-Flash,同步开源 Qwen3.8-Flash-Next(两者为同一模型,前者是 API 版本名称,后者是开源版本的正式名称)。它的成绩相当亮眼。在智能体编程基准 DeepSWE 1.1 上,它拿到 58.7 分,而参数规模是它三倍的前代 Qwen3.7-Plus 只有 16.5 分;

来自主题: AI资讯
9185 点击    2026-08-27 10:33
GPT-5.5反杀Claude登顶,AI编码旧榜不准了?

GPT-5.5反杀Claude登顶,AI编码旧榜不准了?

GPT-5.5反杀Claude登顶,AI编码旧榜不准了?

一个号称「零污染」的新基准 DeepSWE,用113道原创题撕开了旧编程榜单的遮羞布。

来自主题: AI资讯
9698 点击    2026-05-28 10:51
伯克利最强代码Agent屠榜SWE-Bench!用Scaling RL打造,配方全公开

伯克利最强代码Agent屠榜SWE-Bench!用Scaling RL打造,配方全公开

伯克利最强代码Agent屠榜SWE-Bench!用Scaling RL打造,配方全公开

新晋AI编程冠军DeepSWE来了!仅通过纯强化学习拿下基准测试59%的准确率,凭啥?7大算法细节首次全公开。

来自主题: AI技术研报
9221 点击    2025-07-07 15:46