跳到正文

图像生成

AI 画图的最前线:文生图模型迭代、图像编辑能力与创作工具生态的全部动态。

6条精选相关主题AI 视频多模态产品更新

最新精选

第 1–6 条 · 共 6 条
今天10月2日周五
  1. TechCrunch · AI76

    OpenAI 为 ChatGPT 全球推出虚拟试穿和商品收藏功能

    OpenAI 全球推出 ChatGPT 的虚拟试穿和 Favorites 功能,用户可上传自拍、全身照或商品图片,在购物结果中预览服装和配饰效果。新功能使用 ChatGPT Images 2.5,并可将收藏商品与试穿图片保存到应用 Library;用户还可以描述穿搭或上传名人造型图片,让 ChatGPT 寻找可购买的商品。

    推荐理由:文章梳理了 ChatGPT 将虚拟试穿与商品收藏接入购物结果的具体方式,也交代了其与 Google 等既有服务的竞争背景。

9月30日周三
  1. Google Research60

    Google Research 提出 Diffusion Controller 统一并简化 AI 图像生成控制

    Google Research 提出 Diffusion Controller,将图像生成的去噪过程重新表述为连续控制问题,用轻量级控制网络调节生成轨迹。该框架支持灰盒和白盒场景,并通过 SFT、RWL 和 PPO 在 Stable Diffusion v1.4 上进行评估;其完全解锁版本相对基线模型取得了 90% 的胜率。

    推荐理由:Diffusion Controller 将推理时引导与微调统一为连续控制框架,并展示了灰盒和白盒场景下兼顾偏好匹配与图像质量的实现路径。

9月23日周三
7月23日周四
7月1日周三
4月23日周四
  1. Google Research78

    Google Photos 的 Auto frame 可在拍摄后重构照片视角

    Google Photos 已在 Auto frame 中加入基于3D场景理解和生成式 AI 的自动重构功能,可在拍摄后调整相机位置、方向和焦距,生成新的照片视角。该方法先估计3D点图与人脸信息,再用生成式 latent diffusion 模型补全原照片未捕捉到的区域,并可改善人像广角镜头造成的透视畸变。

    推荐理由:Google Photos 将3D场景估计与生成式修补结合,用于自动调整人像视角和广角畸变,展示了生成式编辑介入拍摄构图的具体路径。