Black Forest Labs 发布 Flux 3 Image 支持多步局部编辑
Black Forest Labs 发布了 Flux 3 Image,这是其 Flux 3 模型家族的图像侧版本。该模型支持在不改变图片其他部分的情况下进行多步编辑,涵盖文生图、图生图、文字渲染和照片级真实感。
Black Forest Labs 发布了 Flux 3 Image,这是其 Flux 3 模型家族的图像侧版本。该模型支持在不改变图片其他部分的情况下进行多步编辑,涵盖文生图、图生图、文字渲染和照片级真实感。
Ideogram 推出新模型 Ideogram 4.5,声称能在编辑图像局部时保持其余部分不变,避免产生伪影。该模型适用于产品摄影、室内设计等场景,提供从0.8美分到22美分的四档质量选项,均支持原生2K分辨率,现已通过平台及API开放使用。
Hyper3D 近日上线 Agentic Mode,整合 Rodin 与 LLM 多模态能力,实现自主理解输入并规划建模路径。该功能将生成范围拓展至工业设计,支持从带尺寸图纸生成可调整三维模型。此前其已通过 MCP 接入 Codex、Claude Code 等智能体,旨在降低专业 3D 创作门槛。
Google DeepMind 与导演 Liz Garbus 合作,利用生成式模型修复黑白照片并捕捉人物微表情,在短片《Love, Rendered》中重现了结婚 70 年的 Burt 和 Ethelle 未留影像的初遇记忆。该工作流结合图像恢复与姿态控制,将老年特征映射至年轻形象,旨在通过技术辅助认知衰退患者保留珍贵情感连接。
OpenAI 发布 ChatGPT Images 2.5,旨在将用户的想法、草图和参考照片转化为更具个性化和精致感的图像。该功能致力于生成更能准确反映用户意图的图片,提升创意表达效果。
Google DeepMind 推出 Nano Banana 2 Lite(gemini-3.1-flash-lite-image)和 Gemini Omni Flash(gemini-omni-flash-preview)两款新模型,现已在 Google AI Studio、Gemini API 和 Gemini Enterprise Agent Platform 上线。
推荐理由:原文给出了两款新模型的定价、延迟指标及 API 接入方式,读者可据此评估其在高吞吐图像生成与视频编辑工作流中的实际成本效益。