跳到正文

图像生成

AI 画图的最前线:文生图模型迭代、图像编辑能力与创作工具生态的全部动态。

9条精选相关主题AI 视频多模态产品更新

最新精选

第 1–9 条 · 共 9 条
9月22日周二
  1. 腾讯混元 公众号68

    混元图像 3.5 预览版发布,腾讯推出高性价比专业级生图模型

    腾讯正式发布混元图像 3.5 预览版(Hy Image3.5 preview),定位高性价比专业级生图模型,官方盲测对比 Hy Image3.0 综合能力提升约 30%。

    推荐理由:新模型在多轮编辑与文字渲染上做了针对性优化,配合较低的单图调用成本,有助于降低批量视觉物料生成的试错门槛。

9月10日周四
9月8日周二
9月2日周三
  1. Google AI76

    Google 推出图像生成与编辑工具 Google Pics 并深度整合至 Workspace

    Google 推出基于 Nano Banana 模型的图像创作与编辑工具 Google Pics,面向 Google AI Pro、Ultra 订阅用户及多数 Workspace 商业客户开放。该工具支持独立使用并直接整合至 Docs、Slides 和 Drive,具备物体分割局部修改、图内文字编辑与翻译、单提示词多图生成以及多人协作能力。用户可通过 pics.new 体验相关功能。

    推荐理由:该工具直接嵌入文档与演示文稿工作流,为办公场景下的局部图像微调与图内文案修改提供了开箱即用的协作方案。

8月19日周三
  1. MIT News · AI70

    MIT CSAIL 研究发现大模型生成图像常无法溯源至训练数据,版权归属面临归因衰减

    MIT CSAIL 研究团队在《Nature Communications》发表论文,发现生成式模型存在“归因衰减”现象,在大规模数据训练下生成的图像往往无法溯源至任何单一训练样本。

    推荐理由:原文通过反事实消融实验揭示了归因衰减现象,为探讨大规模训练数据与生成内容侵权判定提供了可验证的技术依据。

7月23日周四
7月6日周一
  1. Hugging Face63

    Photoroom 详解文生图模型 PRX 数据工程策略:从 VLM 重打标到流式训练

    Photoroom 详细公开了 7B 文生图模型 PRX 的预训练数据流水线,通过 Lance 进行海量样本检索与管理,并使用 Qwen3-VL-8B 为图片重新生成详细的长段落描述。

    推荐理由:文章系统复盘了文生图模型预训练的数据工程全流程,为处理大规模图文重打标与流式存储提供了可落地的实操参考。

7月1日周三
4月23日周四
  1. Google Research72

    Google Photos 上线基于 3D 场景估计与生成式 AI 的照片视角重构功能

    Google 宣布在 Google Photos 的 Auto frame 中上线基于 3D 场景理解与生成式 AI 的照片重构功能,支持在拍摄后自动调整人像照片的相机机位和焦距。

    推荐理由:原文展示了解耦 3D 场景估计与扩散模型以重构相机视角的方案,有助于了解生成式 AI 在后期构图与人像畸变修复中的落地细节。