Mai 生成重设计 · per-model skill 第一份
generate-nano-banana:图片侧 skill 草稿
Nano Banana 是 Mai 的默认图像模型。这份 skill 是 3.0 参考层里它的专属文档草稿——模型脾气、调用面、带对照的写法规则、retake 纪律。事实源三处:本机 fal.ai 实战 skill、plat_editon §8 MODE B、generation_models.yaml:39-86。
状态:草稿待批 · 对应 3.0 入口 /generate/nano-banana · 2026-06
4 → 2
旧的 4 个 task 名背后其实只有 2 个真实端点:t2i 和 edit-resize
mode: 2 值
新入口只需 create | edit,比旧工具四选一还简单
auto
比例表里藏着 "auto"(模型自定)——旧 prompt 从没教过模型用它
6 条
写法规则,每条带单行 bad→good 对照
01 · 脾气
为什么"短"对它是对的
Nano Banana 先推理后渲染。skill 开篇就把行为后果讲清楚,让模型知其所以然:
- 给它意图,不要教渲染——过度指定会压掉它自己的语义推理
- 质量词是噪音:8K / masterpiece / 超精细,一律删
- 它有真实世界知识 + 搜索接地:直接点名"故宫角楼的屋檐结构",不用费字描述
- 文字上图是强项(含简体中文):要的字原文引用 + 指定位置和层级
- 跨轮角色一致性是招牌:系列图 / 连续编辑优先用它
02 · 调用面
Mai 入口事实(backend 配置镜像)
| 你想做 | 内部走 | 说明 |
| 文生图 | ultra-nano-banana-t2i | 默认任务默认模型 |
| 编辑 / 参考生成 / 多图融合 | ultra-nano-banana-edit-resize | 旧 4 个 task 名收敛成这 2 个端点 |
| 比例 | auto · 21:9 · 16:9 · 3:2 · 4:3 · 5:4 · 1:1 · 4:5 · 3:4 · 2:3 · 9:16 | auto = 让模型自己定 |
| 不满意时 | nano_banana_2(preview) | 指令遵循更强但可能不稳——作为建议报给用户,不默默切 |
03 · 写法
六条规则,每条带对照
规则 1
一句话说清要发生什么,不教渲染
bad"杰作,8K,超高清,一位美丽的金发女骑士,精致面容,完美比例,电影感光效……"
good"手游买量素材:女骑士拔剑回头的瞬间,黎明逆光,情绪是决意"
规则 2
文字上图:原文引用 + 位置 + 层级
bad"加一些促销文案"
good"标题'双十一狂欢'居中大字,右下角小字'立即下载'"
规则 3
编辑只说改什么 + 保什么,不复述整图
bad"保持图中客厅的布局、墙画、暖色调、地毯纹理、窗帘颜色……把沙发换掉"
good"把沙发换成低背布艺款;其余一切不变"
规则 4
多参考图:每张图一个角色,声明不许串台
good"[图1]管角色长相,[图2]只取姿势;不要把[图2]的画风带过来"
规则 5
因果连接词省着用
good"because X so Y" 只在逻辑关系决定画面时写——它会自己推空间、光影、物理
规则 6
系列图一次改一个轴
good角色锚定靠参考图,不靠形容词复读;先锁身份,再动构图,最后调细节
04 · Retake
不满意的时候
- 一次只改一个变量(措辞 / 比例 / 参考图),别整段重写
- 文字渲染错 → 只重 roll 文字相关那句,其余原样
- 连续两次同样的错 → 换 nano_banana_2 或换模型,把原因告诉用户
两个诚实处理:① MODE B 原文的 "semantic 3D reasoning core" 这类说法是营销话术——skill 只保留行为后果(短而密、信任推理),不搬架构声明。② 模型 ID 和比例表以 backend 配置为准,skill 里只是镜像,避免双源漂移。