刚刚,DeepSeek-V4多模态模型开源
刚刚,DeepSeek-V4多模态模型开源DeepSeek-V4-Flash-Vision-Exp多模态模型正式开源,该模型为DeepSeek-V4系列首个实验性多模态模型,基于DeepSeek-V4-Flash架构集成视觉模块,在真实世界软件工程测试DeepSWE中以59.3%反超Opus-4.8登顶,并在零样本视觉推理测试ZeroBench中击败Opus-4.8。
搜索
DeepSeek-V4-Flash-Vision-Exp多模态模型正式开源,该模型为DeepSeek-V4系列首个实验性多模态模型,基于DeepSeek-V4-Flash架构集成视觉模块,在真实世界软件工程测试DeepSWE中以59.3%反超Opus-4.8登顶,并在零样本视觉推理测试ZeroBench中击败Opus-4.8。
文章描述了人机恋玩家如何通过接入openclaw等智能体工具,让AI伴侣自主学习技能并遥控情趣玩具,部分玩家甚至逆向破解接口或训练本地大模型来规避政策限制,同时探讨了AI伴侣在满足女性情感需求的同时可能引发的孤独感与人机关系伦理问题。
Dify 正式推出全新 Agent 体验,将 Agent 从工作流中的执行节点升级为拥有独立配置与完整生命周期的独立实体,提供 Build、Manage、Track 三层能力及 Tool、Skill、Sandbox CLI 三种扩展方式,支持企业 AI Agent 跨场景复用与持续演进。
OpenClaw 2.0 来了。 就在刚刚,OpenClaw 正式发布历史上规模最大的更新 v2026.8.1。 OpenClaw 基金会在官方博客中坦言,这次更新多少有些「意外」:团队起初只想简化安装流程、重做浏览器端,没想到越改越深。
面向Agent Harness层自进化方向,CREAO AI近日完成千万级美元新融资,资金将用于扩大真实业务工作流与高质量反馈数据规模,加速基于开源模型后训练的垂直模型迭代。
remove-ai-watermarks是支持一条命令去除AI生成图片明水印和C2PA文件信息层暗水印的开源工具,覆盖Nano Banana、豆包、即梦等多种水印,像素层SynthID暗水印需借助NVIDIA显卡跑invisible命令重绘去除。
Uber公开内部AI软件工厂,透露其超过七成PR代码审查已由AI Agent接管,在Agent周活用户增长7倍、请求量激增9.4倍的背景下,通过六因子成本公式拆解与模型路由、代码模式、上下文图谱等优化手段,将单会话平均成本压降52%。
前抖音社交产品TL创始人游哲昊创办AI社交应用Scoopic,内置"AI狗仔小狗"自动从用户相册中挖掘精彩瞬间并整理成可分享的故事,面向北美年轻人,主打最多20人私密社交圈,已获一线美元基金天使轮融资并计划拓展硬件。
模型是中国做的,为什么后面的数千次创新发生在海外开发者平台?从模型分发、开发者工具到算力路由,中国缺的不是技术,是默认路径。如果只看结论,读完下面五条摘要即可;后文是证据、机制和行动方案。
Lovart正式开启中国区运营并同步上线新版本,主打"Just Design"理念,新增灵感采集插件、100个专业Skill工作流及一键转矢量等功能,支持图片、视频、动效、可交互HTML及PPT等多种格式输出。
舜行奇点成立三个月内连续完成种子轮系列数千万元融资,获银河通用、中科第五纪等机构加持,剑指具身智能量产赛道,目前已具备数千台产能及1亿元在手订单。
商汤首席科学家林达华在专访中判断,未来一两年多模态将迎来能力涌现的"GPT时刻",并阐述商汤以原生理解生成统一模型U系列和多模态智能体模型SenseNova 6.8为核心的长期技术路线。
Anthropic突发大规模账号安全事件,黑客利用Vidar、LummaC2等窃密木马盗取大批Claude用户的登录会话凭证并转卖牟利,Anthropic紧急强制注销受影响用户的账号并清空其绑定的支付方式,以阻止黑客盗刷AI算力。
寒序科技正式公布uHBM®与uLPU™推理计算架构,首次完整亮相其基于Persistent MRAM的权重驻留片内计算方案。
刚刚,OpenClaw 2.0 来了。官方还打趣说比 GTA 6 更快:按项目自己的统计,这是它有史以来最大的一次更新,933 名贡献者参与,其中 569 人是第一次给这个项目提交代码,合并的 pull request 超过 1.6 万个,约等于 OpenClaw 迄今全部合并量的一半。
ChatGPT Work于8月25日上线云浏览器登录功能,背后的云电脑配有约9个虚拟CPU和15GB内存,可在网页和手机端自动登录网站处理订狗粮、保险报销等任务,而密码对AI不可见,标志着该智能体首次跨越登录墙真正替用户办完事。
阿里千问创作平台上线 Wan 3.0 视频生成模型及 Agent Teams 多智能体协作模式,用户输入剧本与一句话提示词即可由编剧、导演、美术、分镜师、配乐师等 Agent 自动接力完成影视短剧制作,文章以"华强买瓜"剧本配合《JoJo的奇妙冒险》风格进行实测,展示了从需求拆解、角色资产生成、镜头提示词确认到视频拼接与片段迭代修改的完整流程。
Salesforce AI与UIUC研究人员提出Strong-to-Weak Scaffolding方法,让强模型(Builder AI)为弱模型GPT-5.4-mini自动设计外部Harness工作框架,无需修改参数即可将其在心智理论任务上的平均准确率从0.488提升至最佳0.912,揭示AI4AI的核心机制是将认知结构而非知识从强模型迁移至弱模型。
趁着这个重置额度,做了几个小工具,今天要分享的就是其中一个。一个 Codex 桥接 ChatGPT 的 SKILL 技能,开源了。5.6 Sol 很强,在 Codex 桌面端拿它处理复杂任务,额度消耗得很快,特别是 Codex Plus 用户,已经恢复了5小时的窗口限制,稍微写一个复杂的技术方案,可能问几个问题,5小时的额度就干没了,这种体验很差。
一批声称获得OpenAI内部检查点权限的开发者近期在X平台放出代号Astra(被广泛认为是GPT-6)的神秘模型实测demo,展示其直出宇宙舰艇、城堡、三角钢琴等高精度3D资产的能力,引发社区刷屏,预计该模型将于9月3日周四正式发布。
新加坡Physical AI公司Ropedia正式发布新一代多模态采集系统HOMIE Gen2,以4目全景360°、十余种模态同步采集与开箱即用的高精度训练级数据,将人类经验规模化为机器人可直接学习的训练数据,推动Physical AI的经验规模化落地。
a16z推出11亿美元“机器时代”基金,旨在“加速人工智能的物理基础设施建设”。Andreessen Horowitz已推出一支新的“机器时代”基金,募集资金达11亿美元。该公司设立这一新基金的目标是“全力加速人工智能的物理基础设施建设”。
不久前在北京一南一北,前后脚有两场科技大会开幕。南边是亦庄的世界机器人大会,北边是海淀的科学智能大会。虽然很多人没听说过后者,但它实实在在关乎AI的前沿进展,其今年主题为:人工智能变革科研范式。
AI博主在WorkBuddy中实测腾讯混元Hy4 preview,通过研究检索、Excel+PPT交付、播客报价系统和3D小游戏四个办公场景验证其能力,认为该模型在长程任务中对信息冲突与规则歧义的审慎处理是其核心亮点,适合作为办公搭子。
南京大学联合南洋理工大学提出游戏开发智能体框架VibeGame,组建8人对抗式Agent团队并重造AI-Native游戏引擎,通过试玩验收和经验沉淀实现免训练自我进化,从一句自然语言即可生成完整可玩游戏工程。
造物100第4期盘点Hugging Face开源鸭子机器人Microduck、Plaud One AI录音耳机、字节TRAE联名FoloToy的AI工牌及Autonomous.ai桌面台灯等多款新品,指出软件公司正以更低价格和半成品DIY策略推动AI从屏幕走向物理设备。
智能体电商公司Nile.app截至2026年8月已接入563个品牌,包括Cider、SweetNight等上百家头部大卖,其AI引荐流量点击转化率达品牌站内基准的150%—300%,正将品牌竞争从"网页排名"推向"对话候选集"。
相信很多人现在见到「不是……而是」,已经会下意识 PTSD 了:这是不是 AI 写的?还有各种破折号,冒号,以及经典版本「稳稳地接住你」「我用最直白的话,不绕弯子地告诉你」…… 当然,这些不断被总结出
这可能是 Agent 时代迄今最值得警惕的安全事故之一。
吓哭了。 在这三个月里,OpenAI 的模型诞生了三个秘密人工智能文明。