本文档旨在帮助零基础小白轻松上手Nano Banana图像生成,从注册到生成图片一步步教学

一、什么是Nano Banana?

基本介绍

Nano Banana(官方名称:Gemini 2.5 Flash Image)是谷歌DeepMind在2025年8月推出的AI图像生成与编辑模型-3。它因其强大的图像生成能力而广受欢迎,具有以下特点:

  • 🚀 闪电般的速度:生成图片速度快
  • 🎯 卓越的角色一致性:能够在多张图片中保持同一人物或物体的特征
  • 💰 成本低廉:单张图片成本极低
  • 🎨 高质量的图像生成:能够生成电影质感的图片

核心功能亮点

  1. 智能换装换场景:上传人物或宠物照片,可以在保持主体特征不变的情况下更换服装、背景甚至年代
  2. 多图融合:将多张照片智能合成为一个全新场景
  3. 多轮编辑:像与设计师对话一样,可以多次修改同一张图片
  4. 风格迁移:将一张图片的风格应用到另一张图片的物体上
  5. 照片修复:为黑白老照片上色、修复划痕和缺失细节

模型介绍:gemini-2.5-flash-image-preview

模型特点

gemini-2.5-flash-image-preview 是Nano Banana的官方预览版模型,具有以下特点:

  • 多模态能力:可以同时处理文本和图像输入
  • 强上下文理解:支持32K上下文长度
  • 角色一致性:出色地保持同一角色在不同图片中的特征一致性
  • 快速生成:优化了生成速度,适合实时应用

技术优势

  1. 精准编辑:可以通过自然语言指令对图片进行精准的局部编辑
  2. 多图理解:能够同时理解多张输入图片并提取共同特征
  3. 世界知识:整合了Gemini的世界知识,能理解复杂概念
  4. 多轮对话:支持多轮图片编辑,像与设计师对话一样逐步完善图片

二、准备工作

访问平台

打开浏览器,访问:https://poloai.top(这是用户提供的请求基础地址)

注册账号

  1. 在网站首页找到"注册"或"Sign Up"按钮并点击
  2. 通常可以使用以下方式注册:
    • 电子邮箱注册
    • 使用 LinuxDO继续
  1. 按照提示完成邮箱验证

获取API密钥

API密钥就像是使用AI服务的"钥匙",有了它才能生成图片。

  1. 登录后,在用户控制台或仪表盘中找到 "令牌管理" 选项
  2. 点击 "添加令牌" 按钮进行相关配置,建议将过期时间设置成永不过期,额度设置成无限额度

!!!注意:令牌分组需要根据所使用的模型进行选择(可在模型广场查看模型对应的分组)!!!

  1. 点击"提交"后系统会生成一长串字符,这就是你的API密钥

  1. 重要:立即复制并妥善保存这个密钥!!!

🔒 安全提示:API密钥是个人使用凭证,不要分享给他人,防止被盗用产生额外费用

三、开始生成第一张图片

方法一:在线可视化工具(推荐小白使用)

如果你是零技术基础的小白,可以优先使用平台提供的在线工具:

  1. 登录后寻找 "操练场" 或 "Playground" 功能入口
  2. 在提示词框中输入你想要生成的图片描述
  3. 点击"发送"按钮,等待几秒钟

方法二:用工具测试API (不写代码也能试!)

强烈推荐使用Postman或者Apifox,可以先行测试接口是否正常,成功了再尝试集成到你自己的项目中。以下使用的是Apifox做的原生格式的提交任务的请求:

方法三:通过API调用(适合有一定技术基础的用户)

如果你会简单的编程,或者想将AI功能集成到自己的应用中,可以使用API方式。

环境准备

官网下载anaconda,可以快速部署python环境

Python环境配置

  1. 确保电脑已安装Python(官网下载:https://python.org
  2. 安装必要的库:在命令提示符或终端中运行以下命令:
pip install requests
pip install pillow

代码示例

以下是简单的Python代码示例,复制到编辑器中稍作修改即可使用:

import http.client
import json

conn = http.client.HTTPSConnection("poloai.top")
body = json.dumps({
   "model": "gemini-2.5-flash-image-preview",#指定模型名称
   "stream": True,
   "messages": [
      {
         "role": "user",
         "content": "一只可爱的布偶猫在花园中追逐蝴蝶,阳光明媚,背景虚化"#在这里填写提示词
      }
   ]
})
headers = {
   'Authorization': 'sk-xxxxxxxxxxxxxxxxxx',#将秘钥替换在此处sk-xxxxxxxxxxxxxxxxxx中
   'Content-Type': 'application/json'
}
conn.request("POST", "/v1/chat/completions", body, headers)
res = conn.getresponse()
data = res.read()
print(data.decode("utf-8"))

如何运行代码

  1. 将上述代码复制到文本编辑器中
  2. 你的API密钥替换为实际的API密钥
  3. 保存文件为generate_image.py
  4. 打开命令提示符/终端,导航到文件所在目录
  5. 运行命令:python generate_image.py
  6. 等待结果,成功后控制台会返回完成提示

四、常用提示词(Prompt)生成教程

提示词是你向AI描述想要什么图片的"指令",好的提示词能生成更符合预期的图片。

提示词基本结构

一个完整的提示词通常包含:

  1. 主体:谁/什么(如:一个红发女孩、一只橘猫)
  2. 场景/环境:在哪里(如:在森林中、在咖啡店里)
  3. 动作/状态:在做什么(如:坐着喝茶、奔跑跳跃)
  4. 风格/细节:什么样的(如:电影质感、水彩画风格、细节精细)

提示词公式

[主体],[场景/环境],[动作/状态],[风格/细节],[其他修饰词]

实用提示词示例

人物类

  • 肖像照片:"一个微笑的年轻女性,棕色长发,坐在咖啡馆窗边,自然光,电影质感,浅景深"
  • 职业形象:"一位专业的医生穿着白大褂,在医院走廊,温和自信的表情,写实风格,高清"
  • 奇幻角色:"精灵女王,金色长发,头戴花冠,在发光森林中,魔幻风格,细节精细"

动物类

  • 宠物照片:"一只金色寻回犬在草地上追逐飞盘,阳光明媚,毛发细节清晰,背景虚化"
  • 野生动物:"熊猫在竹林中吃竹子,自然光线,写实照片风格,细节丰富"
  • 奇幻动物:"发光独角兽在星空下站立,魔法特效,梦幻风格"

场景类

  • 自然风景:"雪山下的湖泊,倒影清晰,日出时分,雾霭效果,风景摄影"
  • 城市景观:"未来城市夜景,高楼林立,飞行汽车,霓虹灯光,赛博朋克风格"
  • 室内设计:"现代风格客厅,大窗户,自然光,简约家具,3D渲染效果"

艺术风格类

  • 水彩画:"威尼斯水城,运河与 gondola 船,水彩画风格,柔和色彩"
  • 油画:"向日葵花田,梵高风格,粗犷笔触,鲜艳色彩"
  • 卡通/动漫:"可爱小女孩与猫咪,宫崎骏动画风格,柔和色彩"

提升提示词质量的技巧

  1. 具体化:不要只说"一只狗",应该说"一只微笑的柯基犬在公园里奔跑"
  2. 添加细节:包括光线(自然光、霓虹灯)、天气(晴天、雨天)、材质(木质、金属)等
  3. 指定风格:明确说明想要照片、油画、水彩画、卡通等风格
  4. 参考艺术家:如"毕加索风格"、"莫奈风格"(但注意版权问题)
  5. 使用质量词汇:如"高清"、"4K"、"细节精细"、"专业摄影"

负面提示词

有些平台支持负面提示词,即指定不希望图片中出现的内容:

{
    "prompt": "美丽的海滩日落",
    "negative_prompt": "不要有人物、不要船只、不要垃圾"
}

五、价格与成本分析

官方价格对比

根据搜索结果,官方Gemini 2.5 Flash Image模型的定价为-3

  • 输入文本:每百万token 0.30美元
  • 输出文本:每百万token 2.50美元
  • 图像处理:每百万token 30美元
  • 单张图片成本:约0.039美元(约合人民币0.28元)

💡 省钱小贴士:生成图片前先精心设计提示词,避免多次试错浪费资源。可以先使用平台的免费额度体验。

六、常见问题与解决方案

1. 图片生成失败

  • 可能原因:API密钥错误、网络问题、提示词不符合规范
  • 解决方案
    • 检查API密钥是否正确复制
    • 确认账户余额或积分充足
    • 简化提示词,移除可能违规的内容

2. 图片质量不理想

  • 可能原因:提示词不够具体、风格冲突、内容过于复杂
  • 解决方案
    • 参考本文的提示词教程,添加更多细节
    • 一次只指定一种明确的风格
    • 尝试分步骤生成:先生成主体,再通过编辑功能添加细节

3. 生成速度慢

  • 可能原因:图片尺寸过大、服务器繁忙、提示词过于复杂
  • 解决方案
    • 尝试较小的图片尺寸
    • 避免高峰时段使用
    • 简化提示词结构

4. 提示词被拒绝

  • 可能原因:包含不安全、违规或版权内容
  • 解决方案
    • 避免生成名人、商标或有版权的内容
    • 移除可能涉及暴力、色情等不良内容的关键词
    • 使用更中立、安全的描述

七、高级技巧与最佳实践

迭代优化法

不要期望一次提示词就能生成完美图片,采用迭代优化:

  1. 第一轮:生成基本构图和主体
  2. 第二轮:基于第一张图片,调整颜色和风格
  3. 第三轮:添加细节和精修

混合提示词技巧

结合具体描述和抽象概念:

"一个女孩在读书(具体),周围环绕着知识的魔法光环(抽象),动漫风格"

利用多轮编辑功能

gemini-2.5-flash-image-preview支持多轮编辑,这意味着你可以:

  1. 先生成一张基础图片
  2. 然后基于这张图片,要求AI进行特定修改
  3. 多次重复这个过程,逐步完善图片

例如:

  • "给这个人换一件红色外套"
  • "把背景从城市换成森林"
  • "添加阳光照射的效果"

八、结语

恭喜!通过本文档的学习,你已经从AI图片生成的小白变成了有一定经验的用户。记住,掌握AI图片生成的关键在于多练习、多尝试,不断优化你的提示词技巧。

Nano Banana作为一款强大的图像生成工具,可以为你的创作、工作甚至商业项目提供强大支持。随着AI技术的快速发展,掌握这些技能将会变得越来越有价值。

如果在使用过程中遇到问题,建议:

  1. 多查阅平台的官方文档
  2. 参考本文档的常见问题部分
  3. 加入相关社区交流经验

祝你使用Nano Banana创造出更多精彩的作品!

Logo

中国智能体开发者社区,聚焦智能体与大模型开发,提供前沿资讯、实用工具链、开源项目及行业案例。通过技术沙龙、开发者大赛等活动,促进经验交流与协作,助力开发者快速构建创新智能应用。

更多推荐