
先说结果
「创意设计」是豆包工作里的统一图片创意设计主入口,核心能力是把一句话需求变成专业级视觉物料。覆盖Logo、IP角色、包装、品牌应用、电商主图、信息图、各平台封面(小红书/公众号/B站/抖音等)、Banner、海报、H5等20+种产物类型。不是简单的"文生图",而是一套完整的设计系统:产物路由→澄清门禁→串行读取→核心资产管理→逐张交付,确保每次出图都专业、可控、可复用。
一、这个技能在解决什么痛点
用AI做图的人都遇到过这些问题:
1
出图不可控:同样的提示词,每次出图风格漂移、文字乱码、构图跑偏,像开盲盒。
2
不懂平台规范:小红书封面要什么比例?公众号头图安全区在哪?B站封面的左右分栏对抗式构图怎么用?不知道就只能瞎试。
3
系列图不一致:做一套品牌物料,第一张和第二张风格完全不同,Logo变形、配色漂移,没法用。
4
批量出图效率低:要做10张系列图,一张张生成、一张张确认,还没做完灵感就没了。
5
提示词写不好:不知道怎么描述构图、光影、材质、排版,写出来的提示词AI听不懂,出图效果差。
「创意设计」技能就是为了解决这些痛点设计的:用系统化的设计流程,把AI出图从"开盲盒"变成"可控的专业设计"。
二、两大最高优先级规则
这个技能有两条凌驾于所有其他规则之上的铁律,理解了这两条,就理解了这个技能的核心设计理念:
铁律1
生成一张,立即交付一张
每成功产出1张图片,必须立刻单独调用交付工具把这1张交给用户。不得等一组、一个批次或全部完成后再集中交付。即使一次调用返回多张,也要按顺序逐张交付。这样做的好处是:你能实时看到效果,不满意可以立即调整,不用等全部出完才发现方向错了。
铁律2
任何生图前必须通过澄清门禁
在实际生成图片之前,必须依次完成三个状态:产物特征路由已锁定→澄清门禁已通过→模型改写规则已加载。缺少任意一个时禁止生图。这确保了:出图前已经明确了"做什么类型的图""有没有信息缺失""用什么模型规则",不会盲目出图。
为什么这两条是最高优先级?
传统AI出图的最大问题是"一次性出一堆,然后用户自己挑",效率低且不可控。这两条规则把流程改成了"逐张生成、逐张交付、实时反馈",同时通过澄清门禁确保每次出图前都想清楚了再动手。这是从"工具思维"到"设计思维"的转变。
三、20+产物类型全覆盖
这个技能最强大的地方在于:不是通用文生图,而是为每种产物类型准备了专属的设计规范。命中具体产物类型时,会自动读取对应的特征参考,包括比例、安全区、内容结构、信息层级、必现元素、品类视觉特征、系列规则等。
主要产物类型分类:
| 分类 |
产物类型 |
典型用途 |
| 品牌资产 |
Logo、IP角色、包装 |
品牌识别系统、吉祥物、产品包装 |
| 品牌应用 |
主KV、活动海报、Banner、宣传册、落地页、展会物料 |
品牌传播物料全链路 |
| 电商 |
主图、车图、详情页、A+页、店招、促销图、卖点图 |
淘宝/京东/拼多多/亚马逊商品图 |
| 信息图 |
数据可视化、知识科普图、流程图、时间线、关系图、思维导图 |
教学课件、报告插图、知识海报 |
| 社媒封面 |
小红书、公众号、B站、抖音、快手、朋友圈、微博 |
各平台内容封面与头图 |
| 通用视觉 |
插画、概念图、氛围图、头像、壁纸、场景图 |
不命中具体产物类型的通用图片 |
举个例子:同样是"做一张封面",
→
小红书封面会用手账拼贴/孟菲斯波普/Y2K复古霓虹风格,3:4竖版,大字标题+标签;
→
B站封面会用左右分栏对抗式构图,16:9横版,弹幕感+二次元梗图;
→
公众号头图会用克制专业数据可视化,2.35:1横版,知识洞察+品牌故事感。
同一个需求,不同产物类型,出图规范完全不同——这就是这个技能的专业之处。
四、串行读取协议:四阶段出图法
每次生图严格按同一条链路读取,后一步只能加工前一步已确认的内容:
阶段1
完整读取主SKILL.md:确定工具路径(image_gen/image_edit)、事实边界、核心资产规则、张数策略、最终调用格式。
阶段2
判断产物路由并读取产物特征ref:根据需求判断目标产物类型,读取对应的设计规范(比例、安全区、结构、必现元素等)。命中多个产物时,先做影响范围最大的核心资产,再做下游应用。
阶段3
完成澄清门禁:完整盘点信息缺口,判断是否需要澄清。事实、素材、产物类型、数量、规格等非视觉决策必须澄清;纯审美方向(风格/配色/构图)不澄清,先生成2-4张试稿再选。
阶段4
读取且只读取一个模型改写ref:默认用4.5模型(详细多维度全量内容推演);用户明确要求5.0 Pro时用5.0 Pro(轻改写,点明设计骨架和信息层级)。
关键设计:优先级固定
主SKILL的工具与事实规则 > 澄清后的用户答案 > 产物特征ref的平台/结构/合规要求 > 模型改写ref的Prompt表达方式。
这意味着:用户答案可以覆盖产物ref,但不能覆盖事实边界;模型改写方式不能改变产物结构。整个系统有明确的层级,不会乱。
五、核心资产管理:系列图一致性的秘密
做品牌物料、系列图、套图时,最大的痛点是前后不一致。这个技能用"核心资产"机制解决了这个问题:
1
什么是核心资产:第一张新生成的Logo、IP、包装、产品主图或主KV,一旦作为后续基础使用,即升级为"当前核心资产"。
2
硬规则:一旦存在核心资产,所有衍生物料必须显式引用该核心资产的CDN URL,调用图生图工具(image_edit)进行延展。禁止仅凭文字描述用文生图重新生成相似版本。
3
场景一致性:只要要求保持Logo、IP、人物、产品、包装、主KV、画风、角色身份一致,必须基于核心资产的CDN URL调用图生图生成。
4
用户上传的素材默认是核心资产:除非明确说"仅参考风格",否则用户上传的Logo、品牌图、产品图等都视为核心资产,后续延展必须保持一致。
这样做的效果是:一套品牌物料,无论做多少张,Logo永远是那个Logo,配色永远是那套配色,风格永远是那个风格。
六、照抄即用的使用提示词
帮我做一张小红书封面,主题是"5个AI工具帮你每天早下班1小时"。
要求:
1. 3:4竖版
2. 标题文字要大,带数字钩子
3. 孟菲斯波普风格,高饱和配色
4. 出图后直接给我看
我要做一套新品牌的视觉物料,品牌名"XX",行业是咖啡,定位是年轻潮流。
请按以下顺序执行:
1. 先生成Logo核心资产(横版+竖版)
2. 基于Logo生成3张品牌应用:主KV海报、小红书封面、公众号头图
3. 所有物料保持Logo、配色、字体一致
4. 每张出图后先给我确认,再做下一张
我有一款产品(附图片),要做淘宝电商主图和详情页。
产品信息:
- 名称:XX
- 核心卖点:XX、XX、XX
- 目标人群:XX
请生成:
1. 5张主图(第1张白底主图+4张卖点图)
2. 详情页首屏Banner
3. 保持产品外观一致,基于我上传的产品图延展
帮我做一张知识科普信息图,主题是"AI大模型发展时间线"。
内容要点:
1. 2017年:Transformer论文发布
2. 2020年:GPT-3发布
3. 2022年:ChatGPT发布
4. 2023年:多模态模型爆发
5. 2024年:Agent能力突破
要求:
1. 竖版海报,时间线从下到上
2. 每个节点配图标和简短说明
3. 科技感配色,深色背景+霓虹光效
七、适用场景与边界
适合使用的场景:
✓
从零生成商业/社交媒体创意图片(封面、海报、Banner、主图等)
✓
品牌视觉系统搭建(Logo→IP→包装→品牌应用全链路)
不适合的场景:
✗
纯文字创作:不写文案、不写文章、不做PPT(除非是图片形式的PPT页面)
✗
要求实际发布/排期:只生成图片,不执行发布动作
八、避坑提醒
避坑提醒
1
不要跳过产物路由直接说"帮我做张图"。越具体的产物类型描述,出图越专业。说"小红书封面"比说"做张图"效果好10倍。
2
事实性文字必须给出真实文案。标题、日期、价格、品牌名等核心文字要明确写出,不要用"XX""某某"等占位符,AI不会帮你编。
3
批量生成时先做核心资产再延展。不要一上来就要10张图,先做1张核心资产确认风格,再基于它延展系列图,一致性才有保障。
4
5.0 Pro不是"更好",而是"更轻"。5.0 Pro适合方向性构图决策和PE扩写,4.5适合详细多维度推演。根据需求选择,不是越新越好。
5
不要在prompt里写平台名和用途说明。"小红书封面""抖音风"这类词要转译为视觉风格、构图和信息密度,不要直接写进prompt。
九、一句话收个尾
AI出图的终极境界不是"提示词写得好",而是"用对了系统"。「创意设计」技能把专业设计师的工作流程——需求分析→产物定位→风格探索→核心资产→系列延展——固化成了可复用的系统,让每个人都能做出专业级的视觉物料。
作者声明:本作品含 AI 生成内容