
AI 前沿发现
Civitai
Google's Nano Banana:Gemini 图像编辑保持人物宠物一致
Google Nano Banana 为 Gemini 图像编辑带来更新,重点解决换装、换背景、年代风格调整后人物与宠物形象不一致的问题。支持多图融合、多轮局部编辑与风格混搭,编辑图还能继续生成短视频。文中附适用场景与上手提示,并说明如何在 ComfyUI 中结合 LoRA 做对照测试。
查看原文 →内容为平台聚合整理,原文与最新动态以来源页面为准。
加老师微信 · 免费技术指导
工作流 / 模型 / 云端算力使用问题,1 对 1 免费答疑
扫码进学习交流群
加专属老师微信图文介绍
工具定位
Gemini 应用中的原生图像编辑能力,近期完成一次重要更新,重点解决「换场景后人不像本人」的问题:在改变服装、背景或年代风格时,尽量保持人物、家人甚至宠物的形象一致。用户只需上传照片并用自然语言说明修改意图,即可完成编辑。
核心功能亮点
- 形象一致性:把人物或宠物放进新场景时,模型会尽量保留其原有外貌特征,避免「像但又不完全是」的观感。
- 多图融合:支持一次上传多张照片并合成新画面,例如将本人照片与宠物照片合成为同一场景的合影。
- 多轮编辑:可在上一次生成结果上继续修改,只调整局部(如墙面、书架、家具),其余部分保持不动。
- 风格混搭:将一张图的色彩与纹理迁移到另一张图的物体上,用于服饰、鞋靴等设计草稿。
- 图生视频:编辑完成的图片可回传 Gemini,继续生成一段趣味短视频。
适用场景
- 个人形象照、宠物主题内容的创意制作
- 室内配色与墙纸、家具搭配的效果预览
- 服饰、配件等设计方向的风格试验
- 社交与营销素材的快速草图产出
上手提示
- 优先使用清晰、光照均匀、主体完整的照片,多轮编辑时更稳定。
- 描述尽量具体,写明「保留什么、改变什么」,例如直接说明只替换背景。
- 若需更细粒度的参数控制,可在 ComfyUI 中结合 LoRA、Checkpoint 自定义工作流做对照测试。
- 生成结果建议人工复核;涉及他人肖像时应先取得授权。
作者/来源:CivitaiOfficial
常见问题
Nano Banana 是 Gemini 里的什么功能?
它是 Gemini 应用中的原生图像编辑能力,用户上传照片后用自然语言说明想改什么,就能完成换装、换背景、风格调整等操作,近期更新重点放在人物与宠物的形象一致性上。
换背景或换服装后,人物看起来不像本人怎么办?
上传时尽量选择清晰、光照均匀、主体完整的照片,并在描述中写清「保留什么、改变什么」,例如直接说明只替换背景、人物外貌不动;多轮编辑时逐次小改,比一次要求过多改动更稳定。
可以把本人照片和宠物照片合成到同一张画面吗?
可以。该功能支持一次上传多张照片并合成为新画面,例如把人物照与宠物照放进同一场景,模型会尽量保留两者的原有外貌特征,减少「像但又不完全是」的观感。
编辑完成的图片能继续生成视频吗?
可以,编辑好的图片可回传 Gemini,继续生成一段趣味短视频,适合社交与营销素材的快速草图产出。生成结果建议人工复核,涉及他人肖像时应先取得授权。
想在 ComfyUI 里做更细的控制,有对应思路吗?
可以结合 LoRA、Checkpoint 自定义工作流,对同一组素材做对照测试,便于比较不同参数下的形象保持效果,再决定采用哪种方案出图。