AI资讯新闻榜单内容搜索-AI图像

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: AI图像
疑似OpenAI新图像模型现身Arena,代号「蒙娜丽莎 mona-lisa-1」

疑似OpenAI新图像模型现身Arena,代号「蒙娜丽莎 mona-lisa-1」

疑似OpenAI新图像模型现身Arena,代号「蒙娜丽莎 mona-lisa-1」

这两天,Arena 平台上突然出现一款神秘的图像生成模型,代号「mona-lisa-1」。有人让该模型「生成一张你的创造者的图片」,模型点名 OpenAI 和奥特曼。且有网友用 OpenAI 验证工具检测生成图片后,确认图片中带有 OpenAI 的 SynthID 水印。

来自主题: AI资讯
9148 点击    2026-08-10 14:38
A²-Edit:突破物体类别与掩码精度限制,实现精准参考图编辑

A²-Edit:突破物体类别与掩码精度限制,实现精准参考图编辑

A²-Edit:突破物体类别与掩码精度限制,实现精准参考图编辑

上海交通大学联合上海创智学院团队提出 A²-Edit,它以统一框架支持任意物体类别和任意精度掩码,通过混合 Transformer 专家路由、掩码退火训练及 50 万级多品类数据,让用户只需给出粗略区域,也能完成身份一致、结构完整、自然融合的参考图引导局部编辑。

来自主题: AI技术研报
6882 点击    2026-08-01 10:44
ICML 2026|从「鉴伪」到「修复」,AI图像取证进入闭环时代

ICML 2026|从「鉴伪」到「修复」,AI图像取证进入闭环时代

ICML 2026|从「鉴伪」到「修复」,AI图像取证进入闭环时代

对于 AI 生成图像中可能存在的不自然伪影,我们是否不仅能够将其定位和解释,还能进一步对其进行修复,使图像恢复为更加真实、自然的视觉外观?围绕这一问题,来自北京大学等机构的研究者提出了 GenShield:一个统一的自回归框架,将 AI 生成图像检测 与 图像伪影修复 结合到同一个闭环中,实现从 “诊断” 到 “修复” 的一体化建模。

来自主题: AI技术研报
8226 点击    2026-06-21 10:31
Midjourney即将发布首款AI硬件产品

Midjourney即将发布首款AI硬件产品

Midjourney即将发布首款AI硬件产品

当全球最神秘的AI图像公司决定造硬件,它在赌什么?近日,Midjourney创始人David Holz在社交媒体上宣布:“开始发出第一批Midjourney硬件产品发布邀请,还有少量名额。”

来自主题: AI资讯
11133 点击    2026-06-12 11:18
废片也能变大片!北大开源首个「美学照片重构」模型 | ICML'26

废片也能变大片!北大开源首个「美学照片重构」模型 | ICML'26

废片也能变大片!北大开源首个「美学照片重构」模型 | ICML'26

北大彭宇新团队提出「美学照片重构」新任务,从摄影教学视频中自动构建数据集AesRecon,并开发两阶段模型AesFormer,通过优化构图、视角与人物姿态,提升照片的美感与艺术表现力。

来自主题: AI技术研报
11902 点击    2026-06-08 14:49
谷歌发布AI图像工具新功能,香蕉模型为基座,留给Startup的空间还有多少

谷歌发布AI图像工具新功能,香蕉模型为基座,留给Startup的空间还有多少

谷歌发布AI图像工具新功能,香蕉模型为基座,留给Startup的空间还有多少

今天早上,Google Labs发布了Pomelli最新功能Photoshoot,我们可以从一张产品图片出发,轻松制作高质量定制品牌照片,用于产品营销。Pomelli是Google Labs联合Google DeepMind于2025 年10月推出的AI营销工具实验项目,底层驱动模型为Nano Banana,专为中小企业设计。

来自主题: AI资讯
10827 点击    2026-02-24 09:17
深入感知级别图像理解:UniPercept 统一图像美学、质量与结构纹理感知

深入感知级别图像理解:UniPercept 统一图像美学、质量与结构纹理感知

深入感知级别图像理解:UniPercept 统一图像美学、质量与结构纹理感知

尽管多模态大语言模型(MLLMs)在识别「图中有什么」这一语义层面上取得了巨大进步,但在理解「图像看起来怎么样」这一感知层面上仍显乏力。

来自主题: AI技术研报
7162 点击    2026-01-08 15:23
对标GPT-4o和香蕉!浙大开源ContextGen:布局身份协同新SOTA

对标GPT-4o和香蕉!浙大开源ContextGen:布局身份协同新SOTA

对标GPT-4o和香蕉!浙大开源ContextGen:布局身份协同新SOTA

浙江大学ReLER团队开源ContextGen框架,攻克多实例图像生成中布局与身份协同控制难题。基于Diffusion Transformer架构,通过双重注意力机制,实现布局精准锚定与身份高保真隔离,在基准测试中超越开源SOTA模型,对标GPT-4o等闭源系统,为定制化AI图像生成带来新突破。

来自主题: AI技术研报
10382 点击    2025-12-22 16:08