万字复盘:从模型到可用Agent,WorkBuddy的Harness工程是怎么做的?
万字复盘:从模型到可用Agent,WorkBuddy的Harness工程是怎么做的?WorkBuddy最近很火,实测下来的体感是,harness层似乎搭建得还不错,而且对国内模型的兼容度都做得很好,少有的国内应用厂商做出来的、基于国产模型的可用Agent产品。 这篇文章来自 Work
搜索
WorkBuddy最近很火,实测下来的体感是,harness层似乎搭建得还不错,而且对国内模型的兼容度都做得很好,少有的国内应用厂商做出来的、基于国产模型的可用Agent产品。 这篇文章来自 Work
Databricks的联合创始人兼CEO Ali Ghodsi最近整了一个大活。公司有1.1万名员工,AI相关的开销越来越高,到底该用哪个模型搭配哪种执行框架,才能在省钱的同时保住效果?自己动手做了一次大规模测试。这次测试基于Databricks真实的业务代码,覆盖3家主流云厂商,由3000多名工程师的实际工作产出支撑,涉及多种编程语言和任务类型。
本篇对谈来自知名播客《A Bit Personal》,由主持人Jodi Shelton于2026年6月5日深度专访美光Micron现任CEO Sanjay Mehrotra。在AI基础设施大爆发的时代背景下,这位在存储领域深耕超过45年的科技老兵,系统拆解了存储技术如何跨越传统组件标签,成为驱动AI进化的核心底座。
就在这届Bilibili World上,英伟达首次面向大众玩家展示了搭载RTX Spark超级芯片的笔记本电脑。这款芯片专为个人智能体打造,不仅搭载了Blackwell RTX GPU,连CPU也是出自英伟达的Grace CPU。
前阶跃 Agent 产品负责人钟十六最近的一篇文章,尝试从产品视角回答这个问题。他描绘了一个 Loop 成熟后的未来图景,Agent 将成为自行运转的项目中心,人只需要在关键时刻现身拍板。在他看来,Loop 真正的价值不在于会重复跑任务,而在于它会带着你的每一次判断持续成长,一轮轮变成更懂你的系统,最终沉淀为长期运转的资产。
大模型竞技场的 AI 能力负责人 Peter Gostev,在前几天公开了 63 条几乎是故意为难模型的 3D 提示词;从大型 3D 世界,到各种可游玩的 3D 场景、名画世界,以及极端视角、自然奇观,和元素与宇宙终局场面等。
之前折腾过各种图片滤镜,ASCII 码、圆点、像素风,做出来觉得有意思,但光做滤镜的工具太多了,没什么记忆点。刚好这阵子"人生新成就""地球 Online 成就"在社交媒体上很火。大家把自己的真实经历写成游戏成就的格式,配一个稀有度和达成率,有点自嘲又有点骄傲。
AI 顶会越来越卷了,卷的方向你还猜不到。本周,国际机器学习大会 ICML 在韩国首尔举行。今年 ICML 的 Poster 环节,除了那些极具创新性的论文,也堪称大型学术行为艺术现场。
37.7°C,干趴了一台国家级AI超算。6月底,英国遭遇有记录以来最热的六月。剑桥大学的Dawn——全英最快的AI超算之一——冷却系统当场热瘫,上千块GPU被迫休了一周多的高温假,350多个科研项目全线急刹。
近日,Anthropic官方发了一篇长文专门来讲这件事。 起因是太多人把Claude Code里的两个选项搞混了:一个是模型选择(Model),一个是努力度(Effort)。过去,大家对这两个选项的理解都很简单:换更大的模型,AI就更聪明;把Effort调高,无非是让AI多想一会儿。