深度|GPT-6遇上实时视频,AI游戏和互动内容迎来新赛季
深度|GPT-6遇上实时视频,AI游戏和互动内容迎来新赛季一周之内大语言、图片、视频模型都迎来新赛季:OpenAI的GPT-6 Astra让编码 Agent更好地使用游戏引擎和Blender,自己改场景、自己跑、自己测;GPT-image-2.5上线,更快更强,图片编辑和关键帧动画显著提升;fal和Yoroll分别发布 H3 MaxTurbo和H3 Superfast后训练加速模型,5秒视频3秒内推理,实时生成和互动玩法纷纷涌现。
搜索
一周之内大语言、图片、视频模型都迎来新赛季:OpenAI的GPT-6 Astra让编码 Agent更好地使用游戏引擎和Blender,自己改场景、自己跑、自己测;GPT-image-2.5上线,更快更强,图片编辑和关键帧动画显著提升;fal和Yoroll分别发布 H3 MaxTurbo和H3 Superfast后训练加速模型,5秒视频3秒内推理,实时生成和互动玩法纷纷涌现。
GPT Image 2.5凌晨突发,把改图能力端了出来。
OpenAI发布新一代图像生成模型ChatGPT Images 2.5,在图片细节质量、生成速度、编辑精度及多轮修改一致性上有所提升,并新增Sketch手绘参考、创作模板和图片评论编辑等功能。
先学会画,再学会听话。 LLaDA-Image 在预训练和中期训练阶段直接从图片学习视觉先验,超过 90% 的累计生成训练样本采用 image-only 监督;图文对则集中用于后续语言对齐。模型权重、训练代码和完整配方同步开放。
ECCV 2026论文ART由vivo BlueImage Lab联合哈工大与南大提出,通过将真实参考图作为可微分监督信号的两阶段训练框架,突破了复杂妆容迁移中的伪目标天花板,同步发布了首个2K分辨率妆容数据集MF2K。
新版生图模型GPT Image 2.5虽未正式发布,但已通过ChatGPT弹窗提示向部分用户开放,该模型生成图像极为逼真,已能伪造GPT-6官方发布会和奥特曼全员信等场景,并在生成速度、角色一致性、文字渲染等方面较GPT Image 2有显著提升。
过去两年,AI生图的参数量与清晰度完成了指数级跨越,但真正面向服装行业却依然面临一个极其尴尬的悖论——当GPT、Gemini等顶尖大模型在通用图像生成上大放异彩时,落地到服装产业的深水区,依然满屏是令人出戏的AI味。通用的SOTA模型做得到了“逼真”,却依然做不好“商业”。
现在的 AI 生图有点太强,像 images 2.0 这样的模型,一段 Prompt 敲进去,直接逼真到你怀疑现实的一切。
商汤科技这次正式开源的SenseNova U1.5 Lite,其亮点如下:而且啊,SenseNova U1.5 Lite依旧保持了8B的大小,还能在复杂排版与精准编辑等核心的场景上比肩闭源的GPT-Image-2:
OpenAI 可能正在测试一款新的 AI 图像模型。 这两天,多名海外用户发现,一个名为 luna-lisa-alpha 的神秘模型出现在 LMArena 测试平台中。从目前流出的测试结果来看,luna-lisa-alpha 重点提升了几个方向,包括人物一致性、图像真实感、文字生成能力,以及此前 GPT Image 系列一直存在的噪点问题。