AI资讯新闻榜单内容搜索-Gen

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Gen
OpenAI 刚刚开源了 PaperBench,用于评估 Agent 复现顶尖论文能力!

OpenAI 刚刚开源了 PaperBench,用于评估 Agent 复现顶尖论文能力!

OpenAI 刚刚开源了 PaperBench,用于评估 Agent 复现顶尖论文能力!

PaperBench 是一个由 OpenAI 开发的基准测试,旨在评估 AI Agent 复现尖端 AI 研究的能 力。它专注于测试 AI 是否能理解研究论文、独立开发代码并执行实验以复现研究结果。

来自主题: AI技术研报
7185 点击    2025-04-03 10:57
OpenAI官方基准测试:承认Claude遥遥领先(狗头)

OpenAI官方基准测试:承认Claude遥遥领先(狗头)

OpenAI官方基准测试:承认Claude遥遥领先(狗头)

刚刚开源的新基准测试PaperBench,6款前沿大模型驱动智能体PK复现AI顶会论文,新版Claude-3.5-Sonnet显著超越o1/r1排名第一。与去年10月OpenAI考验Agent机器学习代码工程能力MLE-Bnch相比,PaperBench更考验综合能力,不再是只执行单一任务。

来自主题: AI资讯
7995 点击    2025-04-03 10:37
Vibe Agent: Token成本直降90%,会对话就能创造专属本地Agent

Vibe Agent: Token成本直降90%,会对话就能创造专属本地Agent

Vibe Agent: Token成本直降90%,会对话就能创造专属本地Agent

刚刚,Local AI 领域的 Libra 团队发布了一段最新技术演示视频,展示了用户通过自然语言交互直接生成 Agent,并利用本地消费级算力支持 Agent 进行长程 (Long-Horizon) 推理,最终完成复杂任务。

来自主题: AI资讯
6938 点击    2025-04-02 15:43
途牛“AI助手小牛”正式上线

途牛“AI助手小牛”正式上线

途牛“AI助手小牛”正式上线

4月1日,途牛旅游网自主研发的“AI助手小牛”旅游应用Agent正式上线途牛旅游APP、“AI助手小牛”小程序。“AI助手小牛”结合旅行垂直应用场景与开源大模型(DeepSeek、通义千问),实现了机票、酒店、火车票快捷查询、预订服务,能够为用户提供智能、专业的“0搭售"旅游服务方案。

来自主题: AI资讯
7242 点击    2025-04-02 09:33
“Apple AI”中文版正式上线:还不太好用,但确实很“苹果”

“Apple AI”中文版正式上线:还不太好用,但确实很“苹果”

“Apple AI”中文版正式上线:还不太好用,但确实很“苹果”

3月31日,随着iOS18.4更新,Apple Intelligence正式支持包括简体中文、法语、德语、意大利语、葡萄牙语(巴西)、西班牙语、日语和韩语在内的多种语言,并提供新加坡和印度版本的本地化英语。

来自主题: AI资讯
5983 点击    2025-04-02 09:10
这篇综述,LLM代理的方法、应用和挑战,2025的Agent势头特别猛。| 重磅

这篇综述,LLM代理的方法、应用和挑战,2025的Agent势头特别猛。| 重磅

这篇综述,LLM代理的方法、应用和挑战,2025的Agent势头特别猛。| 重磅

2025年,人工智能领域正在经历一场由LLM Agent引发的深刻变革,不管普通人的衣食住行还是研究者的尖端研究,都很难不受Agent的影响。

来自主题: AI技术研报
9529 点击    2025-04-01 10:06
一张照片生成连贯全片!Runway Gen-4 深夜发布,终于捅破 AI 视频多年的天花板

一张照片生成连贯全片!Runway Gen-4 深夜发布,终于捅破 AI 视频多年的天花板

一张照片生成连贯全片!Runway Gen-4 深夜发布,终于捅破 AI 视频多年的天花板

今天凌晨,Runway的新版本Gen-4又试图解决AI视频的一个关键难题,让AI视频更靠近电影级。这一切都只发生在短短的2个多月内,很难想象今年AI会发展到什么程度,或许今年将会是GPT-3.5后真正的AI爆发年。

来自主题: AI资讯
9149 点击    2025-04-01 09:06
一秒十图!英伟达MIT联手刷新SOTA,一步扩散解锁实时高质量可控图像生成

一秒十图!英伟达MIT联手刷新SOTA,一步扩散解锁实时高质量可控图像生成

一秒十图!英伟达MIT联手刷新SOTA,一步扩散解锁实时高质量可控图像生成

SANA-Sprint是一个高效的蒸馏扩散模型,专为超快速文本到图像生成而设计。通过结合连续时间一致性蒸馏(sCM)和潜空间对抗蒸馏(LADD)的混合蒸馏策略,SANA-Sprint在一步内实现了7.59 FID和0.74 GenEval的最先进性能。SANA-Sprint仅需0.1秒即可在H100上生成高质量的1024x1024图像,在速度和质量的权衡方面树立了新的标杆。

来自主题: AI技术研报
8207 点击    2025-03-31 16:16