#图像生成
#图像生成
ArtificialAnlys@ArtificialAnlysAI 评分
Alibaba_Qwen@Alibaba_Qwen精选AI 评分 推荐理由:原文说明了加速方案与原模型的关系及接入方式,读者可据此评估它对现有图像工作流的提速价值。
_akhaliq@_akhaliqAI 评分 Qwen-Image-2.1-Multiple-Angles-LoRA Model: huggingface.co/akhaliq/Qwen-…
op7418@op7418AI 评分 arena@arenaAI 评分 arena@arena精选AI 评分 推荐理由:原文给出了三个榜单的具体名次和相对前代的分数提升,读者可据此判断这次升级的幅度。
The DecoderAI 评分Google 发布图像生成模型 Nano Banana 2.1,价格约为 Nano Banana 2 的一半
Google 发布图像生成与编辑模型 Nano Banana 2.1,取代 2026 年 2 月发布的 Nano Banana 2,官方称其在各方面均有提升,基于 Gemini 3.6 Flash。
Google@GoogleAI 评分 Google 发布最新图像生成与编辑模型 Nano Banana 2.1,称该升级版在各方面超越此前模型,在视觉设计、基于 mask 的编辑和主体一致性上有明显提升,帮助用户创建更自然的图像。
X:Testing Catalog (@testingcatalog)AI 评分 Black Forest Labs 发布 FLUX 3 Image 图像模型,支持 4K 精确编辑
Black Forest Labs 发布 FLUX 3 Image,一款支持 4K 精确编辑的新图像模型。用户已可在 Tools Playground 中试用新功能,开放权重计划在未来几周内发布。
The DecoderAI 评分Ideogram 发布 Ideogram 4.5,称可局部编辑图像而不影响其余画面
Ideogram 发布新模型 Ideogram 4.5,称其只修改用户指定的区域,替换服装时人物身形与背景保持不变,可减少多次编辑后的画面瑕疵。
arena@arenaAI 评分 ArtificialAnlys@ArtificialAnlysAI 评分 ArtificialAnlys@ArtificialAnlysAI 评分 ViggleAI@ViggleAIAI 评分
The DecoderAI 评分Black Forest Labs 发布 Flux 3 Image,支持多步编辑且不改动画面其余部分
Black Forest Labs 发布 Flux 3 模型家族中的图像模型 Flux 3 Image,官方称其支持多步编辑而不改动图像其他部分,覆盖文生图、图生图、文字渲染和照片级真实感。
t_mux@t_muxAI 评分 viggle-turbo for Qwen-Image-2.1 不只是更快——对大多数提示词来说,效果与 base 一样好。
TheInclusionAI@TheInclusionAIAI 评分 Alibaba_Qwen@Alibaba_QwenAI 评分 感谢 @arena 的认可!🏆 Qwen-Image-2.1 现在是 Image Edit 和 Text-to-Image 榜单上的 #1 开源模型。快来试试,展示你的创作!🎨
AntLingAGI@AntLingAGIAI 评分
wildmindai@wildmindaiAI 评分 TencentHunyuan@TencentHunyuanAI 评分 TencentHunyuan@TencentHunyuanAI 评分
Alibaba_Qwen@Alibaba_QwenAI 评分 Alibaba_Qwen@Alibaba_QwenAI 评分 Qwen-Image-2.1 支持多种图像编辑任务并在各项任务间平衡性能。原文举例说明,给定一张三视图角色参考图,该模型可以生成完整的分镜。
Alibaba_Qwen@Alibaba_Qwen精选AI 评分 Qwen 官方宣布 Qwen-Image-2.1 开放权重,称其为 Qwen-Image 系列中最均衡、最具性价比的模型,采用统一架构同时支持生成与编辑。
推荐理由:原文列出了架构规模、透明度与编辑能力等具体变化,读者可据此判断它对现有图像工作流的替代空间。
sankakuten91256@sankakuten91256AI 评分
Google DeepMind精选AI 评分Google DeepMind 发布 Nano Banana 2 Lite 与 Gemini Omni Flash
Google DeepMind 发布 Nano Banana 2 Lite(gemini-3.1-flash-lite-image)和 Gemini Omni Flash(gemini-omni-flash-preview)两款模型,前者是 Nano Banana 家族中速度最快、成本最低的图像模型,后者支持高质量视频生成与对话式编辑。
推荐理由:Google DeepMind 同时放出图像与视频两款新模型,并给出延迟、单价和可用入口,便于开发者评估替换与串联方案。
Google DeepMind精选AI 评分Google DeepMind 发布 Nano Banana 2(Gemini 3.1 Flash Image)图像模型
Google DeepMind 发布 Nano Banana 2(Gemini 3.1 Flash Image),把 Nano Banana Pro 的世界知识、推理与画质带到 Flash 级速度。
推荐理由:原文列出 Nano Banana 2 在主体一致性、文字渲染和分辨率上的具体规格,可对照 Pro 版判断速度与质量的取舍。
Google DeepMind精选AI 评分Google DeepMind 发布 Gemini 3 Pro Image(Nano Banana Pro)图像模型
Google DeepMind 发布 Nano Banana Pro(Gemini 3 Pro Image),这是基于 Gemini 3 Pro 构建的高保真图像生成与编辑模型,已在 Google AI Studio 和 Vertex AI 面向企业以付费预览形式逐步开放。
推荐理由:Google DeepMind 发布 Gemini 3 Pro Image,开发者可据此了解其分辨率、文本渲染与 Google 搜索接地等能力边界。
Google DeepMind精选AI 评分Google DeepMind 发布 Nano Banana Pro(Gemini 3 Pro Image)图像生成与编辑模型
Google DeepMind 发布 Nano Banana Pro(Gemini 3 Pro Image),基于 Gemini 3 Pro 构建,主打更强推理与世界知识、图像内多语言文字渲染,以及最多融合 14 张图像、保持 5 人一致性的编辑能力,支持 2K 和 4K 分辨率与多种画幅。
推荐理由:官方给出 Nano Banana Pro 的能力边界与各产品上线节奏,读者可据此判断图像生成在自身工作流中的可用性。
OpenAI News精选AI 评分 OpenAI 在 API 中上线最新图像生成模型 gpt-image-1
OpenAI 宣布最新图像生成模型以 gpt-image-1 的形式在 API 中开放,开发者和企业可将专业级、可定制的视觉内容直接构建进自有工具和平台。
推荐理由:OpenAI 将最新图像生成模型以 gpt-image-1 接入 API,开发者可据此评估自有工具接入图像生成的路径。
OpenAI News精选AI 评分 OpenAI 在 GPT-4o 中引入原生图像生成
OpenAI 发布 GPT-4o 的原生图像生成能力,官方称其在文字渲染和指令遵循方面更强。该发布还提到可了解 ChatGPT Images 2.5。
推荐理由:OpenAI 官方说明 GPT-4o 原生图像生成在文字渲染与指令遵循上的变化,可对照此前图像生成能力。
OpenAI News精选AI 评分 OpenAI 发布 GPT-4o 系统卡附录:4o 图像生成
OpenAI 发布 GPT-4o 系统卡附录,介绍 4o 图像生成。该能力比此前的 DALL·E 3 系列模型显著更强,可生成照片级真实感输出,也能接收图像作为输入并进行变换。
推荐理由:GPT-4o 图像生成能力较 DALL·E 3 明显提升,并支持图像输入与变换,可据此了解其能力边界。
Hugging Face Blog精选AI 评分
Diffusers 支持 Stable Diffusion 3.5 Large
Hugging Face 博客宣布 Diffusers 库已支持 Stable Diffusion 3.5 Large 模型。原文正文抓取失败,仅标题可用。
Hugging Face Blog精选AI 评分
Diffusers 集成 Stable Diffusion 3 Medium,2B 参数模型上线 Hugging Face Hub
Stability AI 的 Stable Diffusion 3 Medium(2B 参数)已在 Hugging Face Hub 发布,并可通过 Diffusers 调用,官方同时提供 DreamBooth 与 LoRA 训练脚本。
推荐理由:原文给出 SD3 Medium 的架构变化与 Diffusers 集成细节,读者可据此判断显存占用与推理速度的取舍。
OpenAI News精选AI 评分 OpenAI 发布 DALL·E 3 系统卡
OpenAI 发布 DALL·E 3 系统卡,说明该图像生成模型在安全与部署方面的评估情况。
Hugging Face BlogAI 评分
Hugging Face 开源 SD-Small 与 SD-Tiny 的知识蒸馏代码和权重
Hugging Face 开源了 SD-Small 和 SD-Tiny 的知识蒸馏代码与模型权重。
Hugging Face BlogAI 评分
rinna 发布日语版 Stable Diffusion 模型
rinna 通过对 Stable Diffusion 进行微调,开发出支持日语提示词的文本生成图像模型 Japanese Stable Diffusion,模型已在 Hugging Face 和 GitHub 发布,代码基于 🧨 Diffusers。