AI资讯新闻榜单内容搜索-大模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 大模型
至知研究院提出大模型可解释性新路线:直接拆权重,数据成本不到1%

至知研究院提出大模型可解释性新路线:直接拆权重,数据成本不到1%

至知研究院提出大模型可解释性新路线:直接拆权重,数据成本不到1%

大模型机制可解释性研究中,一直存在一个颇具反差的现实: 为了理解一个已经训练好的模型,研究者往往需要先训练一套新的稀疏表示。

来自主题: AI技术研报
6200 点击    2026-08-19 14:39
大模型是残酷的制造业

大模型是残酷的制造业

大模型是残酷的制造业

大模型的版本告一段落,AI应用的新版本已经到来。

来自主题: AI资讯
6214 点击    2026-08-19 11:06
Cherry Studio 复盘:从 Chat 到 Agent,一款「套壳」开源产品如何推倒重来?

Cherry Studio 复盘:从 Chat 到 Agent,一款「套壳」开源产品如何推倒重来?

Cherry Studio 复盘:从 Chat 到 Agent,一款「套壳」开源产品如何推倒重来?

「套壳」是 Cherry Studio 最大的标签。但这个「壳」,在过去一年成了 GitHub 上增长最快的 AI 桌面应用之一。Cherry Studio 最初的目标很明确,就是帮用户在不同大模型之间自由切换,做一个更好用的聊天客户端。

来自主题: AI资讯
7112 点击    2026-08-18 15:28
机器人也有“Aha Moment”!Zetta ζ 闭环物理智能体在线学习

机器人也有“Aha Moment”!Zetta ζ 闭环物理智能体在线学习

机器人也有“Aha Moment”!Zetta ζ 闭环物理智能体在线学习

端到端策略模型在物理世界频频失灵,研究者转向 “大模型智能体 + 工具调用” 自救,试图在动态物理世界中持续学习。然而,这条在线学习路径在物理世界仍未真正走通。

来自主题: AI技术研报
7192 点击    2026-08-18 15:27
挑战 1 比特!ETH Zürich 秦浩桐:如何把大模型「塞进」小设备?| IJCAI 2026

挑战 1 比特!ETH Zürich 秦浩桐:如何把大模型「塞进」小设备?| IJCAI 2026

挑战 1 比特!ETH Zürich 秦浩桐:如何把大模型「塞进」小设备?| IJCAI 2026

面对大模型规模与硬件内存之间高达20倍的算力鸿沟,不重训的“1比特量化”如何把千亿参数的硅基大脑塞进微型设备?

来自主题: AI资讯
8561 点击    2026-08-18 15:09
独家 | 字节内测“漫剧创作工具”:搭载豆包大模型,支持20万字剧本上传

独家 | 字节内测“漫剧创作工具”:搭载豆包大模型,支持20万字剧本上传

独家 | 字节内测“漫剧创作工具”:搭载豆包大模型,支持20万字剧本上传

《读佳》获知,字节正在内测一款漫剧创作产品,名字就叫“漫剧创作工具”,Slogan“让创作更纯粹”,搭载豆包多个大模型。

来自主题: AI产品测评
6927 点击    2026-08-18 11:53
Kimi熹妃回宫

Kimi熹妃回宫

Kimi熹妃回宫

在OpenAI一时半会没憋出来GPT 6的情况下,大模型排行榜被中国团队卷成麻花了。

来自主题: AI资讯
10230 点击    2026-08-18 11:13
Z Tech|专访00后港大博士、Evolvent AI创始人胡梦康:Agent之后,下一站是AI自我进化

Z Tech|专访00后港大博士、Evolvent AI创始人胡梦康:Agent之后,下一站是AI自我进化

Z Tech|专访00后港大博士、Evolvent AI创始人胡梦康:Agent之后,下一站是AI自我进化

过去几年,大模型的发展主线很清晰,比如更大的模型、更多的数据,以及更多的计算。但当模型从回答问题的Chatbot走向能够调用工具、执行任务的Agent,发展主线也开始发生变化。模型不仅要知道,还要在环境中行动,从反馈中判断结果,并在长时间运行中不断调整策略。

来自主题: AI资讯
6519 点击    2026-08-17 16:03
北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

过去几年,大模型推理系统优化的核心目标一直围绕一个问题展开:如何让 GPU 更高效地计算权重、激活、KV Cache 等高维张量?从并行策略、请求调度、显存管理到算子优化,学界业界大量优化技术不断提升模型推理效率。

来自主题: AI技术研报
9744 点击    2026-08-17 15:18