实测阿里万有无界:让小万建群,它说人没齐死活不建
实测阿里万有无界:让小万建群,它说人没齐死活不建每天1000个注册名额,凌晨6点刷新,用完了就得进Waitlist排队,等短信通知。
搜索
每天1000个注册名额,凌晨6点刷新,用完了就得进Waitlist排队,等短信通知。
在AI应用生成这个赛道上,选手已经排到了两位数。腾讯有吐司,百度有秒哒,字节有Trae,阿里自家就有Qoder,现在又冒出来一个「袋马」。
上一篇我用 Doubao-Seed-Evolving,把复杂 PRD 拆成可执行工程,做成了 AI 教学视频平台。那次重点是“知识驱动出片”:学科知识点 → 教学分镜 → 配音 → 动画 → 1080p 成片。
8 月 3 日,Qwen 官方正式发布 Qwen3.8-Max。
DeepSeek-V4-Flash风评冲爆了,原生支持接入Codex,而且还强化了Agent能力。我第一时间把它接进了Codex,用cc swich非常方便。一个小时,跑了一亿多token。跟大家说说体感。
7月27日,美团正式上线了CatPaw,一个全场景AI Agent平台。准确说,是「内部练了三年,现在放出来给所有人用」。
谷歌的前端功底有多深,不需要任何人来认证。
千问说它可以帮我拼九宫格了,还是不同主题的那种。
WAIC 2026上,百度秒哒带来了3.5版本。据官方数据,秒哒累计服务超过3500万用户,创造了350万个具有商业价值的应用,每天有近20万人在使用这些应用解决真实问题。
开始忘记软件以后,创作才真正开始。
最近有三个女孩火了。
面壁智能上周开源了一个叫 StaffDeck 的东西。
我刚刚 AGI Bar 小程序里建了一个共享钱包,并往里面充了 1 万块,未来 24h可点开领取
发布之前,我在 X 上看到有人说,测 K3 的感觉就像在测 Fable 5。虽然离 Fable 5 还差一点点 🤏,但超过 Opus 4.8 和 GPT 5.5 基本没有问题。在前端能力,K3 的提升非常明显,我已经用它复刻了前段时间爆火的独立工作室 Abeto 推出的一款 3D 网页游戏 《 Messenger》(ps. 音乐手动配的,主角模型是 K3 自己判断、自主去游戏官网找的)
今天凌晨看到 Arena AI 更新 Code Arena 榜单时,我第一反应是有点意外。刚刚发布的 Kimi K3 拿到了 1679 分,排在全球第一,压过了 Claude Fable 5 的 1631 分和 GPT-5.6 Sol 的 1618 分。
大家好,我是袋鼠帝。 前几天,火山的朋友提前跟我同步了一个消息,说豆包Seed模型又更新了。
不知不觉,整个AI影像行业全线迈进了Agent创作与AI视频C端普及的时代。
过去半年,国产大厂扎堆发布一种新东西:桌面Agent。如果你最近在刷相关讨论,会发现 WorkBuddy、豆包专业版、QoderWork 这三个名字出现得特别频繁。如果一个普通办公用户今天就想选一款桌面 Agent,到底该先试谁?
7 月 8 日,xAI 发布了 Grok 4.5。马斯克给的定位很直白,「Opus 级别,但更快,更便宜」。
AI 生图最难的地方,早就从「生成一张好看的图」变成了「把那张差一点的图改对」。
用 AI 生图的人,应该都体会过这种痛苦。
大家好,我是冷逸。 前段时间,我设计了一家民宿「冷同学的院子」,视觉还算有点意思,不少朋友跑来问设计上的事。也有人问我:要是自己网上开店,有没有那种“够简单、说一句就能出设计”的电商工具?
我自己花时间,把三款主流国产桌面 Agent 从头到尾测了一遍:Trae、WorkBuddy、ZCode。用三个最日常的工作任务——做 PPT、分析表格、写小游戏,看看它们到底能不能帮普通打工人干活。这篇文章就是完整的实测记录,希望对你选工具有点帮助。
7 月 9 日,OpenAI 一口气发了三样东西,新模型 GPT-5.6,一个把 Chat、Work、Codex 装进同一个壳的新桌面应用,以及本文的主角 ChatGPT Work。官方的说法是,ChatGPT 从此不再只是回答问题,而是把活真正干完,交出来的不是聊天记录,是表格、文档、PPT,甚至一个能直接分享的网站。
最近这段时间,国内外模型更新得很快。
上个月也就是昨天,我写了一篇LongCat 2.0的实测,用四个任务测了一下它的编程能力,当时我的评价是「有些地方惊艳,有些地方还差点意思」。
微信和企业微信的 Agent,同时出牌。
你有没有想过一个问题: 我们平时选模型,到底有多少是因为它真的好用,又有多少是因为它便宜?
阿辉又跟我们吐槽了。
Anthropic增加绿卡认证后,最开心是智谱,直接原地化身战狼,高呼「前沿智能属于所有人」,提前把专注Coding的GLM5.2发了。