豆包工作创意设计技能:从一句话到专业级视觉物料,20+产物类型全覆盖

豆包工作创意设计技能

先说结果
「创意设计」是豆包工作里的统一图片创意设计主入口,核心能力是把一句话需求变成专业级视觉物料。覆盖Logo、IP角色、包装、品牌应用、电商主图、信息图、各平台封面(小红书/公众号/B站/抖音等)、Banner、海报、H5等20+种产物类型。不是简单的"文生图",而是一套完整的设计系统:产物路由→澄清门禁→串行读取→核心资产管理→逐张交付,确保每次出图都专业、可控、可复用。

一、这个技能在解决什么痛点

用AI做图的人都遇到过这些问题:

1
出图不可控:同样的提示词,每次出图风格漂移、文字乱码、构图跑偏,像开盲盒。
2
不懂平台规范:小红书封面要什么比例?公众号头图安全区在哪?B站封面的左右分栏对抗式构图怎么用?不知道就只能瞎试。
3
系列图不一致:做一套品牌物料,第一张和第二张风格完全不同,Logo变形、配色漂移,没法用。
4
批量出图效率低:要做10张系列图,一张张生成、一张张确认,还没做完灵感就没了。
5
提示词写不好:不知道怎么描述构图、光影、材质、排版,写出来的提示词AI听不懂,出图效果差。

「创意设计」技能就是为了解决这些痛点设计的:用系统化的设计流程,把AI出图从"开盲盒"变成"可控的专业设计"

二、两大最高优先级规则

这个技能有两条凌驾于所有其他规则之上的铁律,理解了这两条,就理解了这个技能的核心设计理念:

铁律1
生成一张,立即交付一张
每成功产出1张图片,必须立刻单独调用交付工具把这1张交给用户。不得等一组、一个批次或全部完成后再集中交付。即使一次调用返回多张,也要按顺序逐张交付。这样做的好处是:你能实时看到效果,不满意可以立即调整,不用等全部出完才发现方向错了。
铁律2
任何生图前必须通过澄清门禁
在实际生成图片之前,必须依次完成三个状态:产物特征路由已锁定→澄清门禁已通过→模型改写规则已加载。缺少任意一个时禁止生图。这确保了:出图前已经明确了"做什么类型的图""有没有信息缺失""用什么模型规则",不会盲目出图。
为什么这两条是最高优先级?
传统AI出图的最大问题是"一次性出一堆,然后用户自己挑",效率低且不可控。这两条规则把流程改成了"逐张生成、逐张交付、实时反馈",同时通过澄清门禁确保每次出图前都想清楚了再动手。这是从"工具思维"到"设计思维"的转变。

三、20+产物类型全覆盖

这个技能最强大的地方在于:不是通用文生图,而是为每种产物类型准备了专属的设计规范。命中具体产物类型时,会自动读取对应的特征参考,包括比例、安全区、内容结构、信息层级、必现元素、品类视觉特征、系列规则等。

主要产物类型分类:

分类 产物类型 典型用途
品牌资产 Logo、IP角色、包装 品牌识别系统、吉祥物、产品包装
品牌应用 主KV、活动海报、Banner、宣传册、落地页、展会物料 品牌传播物料全链路
电商 主图、车图、详情页、A+页、店招、促销图、卖点图 淘宝/京东/拼多多/亚马逊商品图
信息图 数据可视化、知识科普图、流程图、时间线、关系图、思维导图 教学课件、报告插图、知识海报
社媒封面 小红书、公众号、B站、抖音、快手、朋友圈、微博 各平台内容封面与头图
通用视觉 插画、概念图、氛围图、头像、壁纸、场景图 不命中具体产物类型的通用图片

举个例子:同样是"做一张封面",

小红书封面会用手账拼贴/孟菲斯波普/Y2K复古霓虹风格,3:4竖版,大字标题+标签;
B站封面会用左右分栏对抗式构图,16:9横版,弹幕感+二次元梗图;
公众号头图会用克制专业数据可视化,2.35:1横版,知识洞察+品牌故事感。

同一个需求,不同产物类型,出图规范完全不同——这就是这个技能的专业之处。

四、串行读取协议:四阶段出图法

每次生图严格按同一条链路读取,后一步只能加工前一步已确认的内容:

阶段1
完整读取主SKILL.md:确定工具路径(image_gen/image_edit)、事实边界、核心资产规则、张数策略、最终调用格式。
阶段2
判断产物路由并读取产物特征ref:根据需求判断目标产物类型,读取对应的设计规范(比例、安全区、结构、必现元素等)。命中多个产物时,先做影响范围最大的核心资产,再做下游应用。
阶段3
完成澄清门禁:完整盘点信息缺口,判断是否需要澄清。事实、素材、产物类型、数量、规格等非视觉决策必须澄清;纯审美方向(风格/配色/构图)不澄清,先生成2-4张试稿再选
阶段4
读取且只读取一个模型改写ref:默认用4.5模型(详细多维度全量内容推演);用户明确要求5.0 Pro时用5.0 Pro(轻改写,点明设计骨架和信息层级)。
关键设计:优先级固定
主SKILL的工具与事实规则 > 澄清后的用户答案 > 产物特征ref的平台/结构/合规要求 > 模型改写ref的Prompt表达方式。

这意味着:用户答案可以覆盖产物ref,但不能覆盖事实边界;模型改写方式不能改变产物结构。整个系统有明确的层级,不会乱。

五、核心资产管理:系列图一致性的秘密

做品牌物料、系列图、套图时,最大的痛点是前后不一致。这个技能用"核心资产"机制解决了这个问题:

1
什么是核心资产:第一张新生成的Logo、IP、包装、产品主图或主KV,一旦作为后续基础使用,即升级为"当前核心资产"。
2
硬规则:一旦存在核心资产,所有衍生物料必须显式引用该核心资产的CDN URL,调用图生图工具(image_edit)进行延展。禁止仅凭文字描述用文生图重新生成相似版本
3
场景一致性:只要要求保持Logo、IP、人物、产品、包装、主KV、画风、角色身份一致,必须基于核心资产的CDN URL调用图生图生成。
4
用户上传的素材默认是核心资产:除非明确说"仅参考风格",否则用户上传的Logo、品牌图、产品图等都视为核心资产,后续延展必须保持一致。

这样做的效果是:一套品牌物料,无论做多少张,Logo永远是那个Logo,配色永远是那套配色,风格永远是那个风格

六、照抄即用的使用提示词

提示词 1:单张封面快速出图
帮我做一张小红书封面,主题是"5个AI工具帮你每天早下班1小时"。

要求:
1. 3:4竖版
2. 标题文字要大,带数字钩子
3. 孟菲斯波普风格,高饱和配色
4. 出图后直接给我看
提示词 2:品牌物料套图
我要做一套新品牌的视觉物料,品牌名"XX",行业是咖啡,定位是年轻潮流。

请按以下顺序执行:
1. 先生成Logo核心资产(横版+竖版)
2. 基于Logo生成3张品牌应用:主KV海报、小红书封面、公众号头图
3. 所有物料保持Logo、配色、字体一致
4. 每张出图后先给我确认,再做下一张
提示词 3:电商主图+详情页
我有一款产品(附图片),要做淘宝电商主图和详情页。

产品信息:
- 名称:XX
- 核心卖点:XX、XX、XX
- 目标人群:XX

请生成:
1. 5张主图(第1张白底主图+4张卖点图)
2. 详情页首屏Banner
3. 保持产品外观一致,基于我上传的产品图延展
提示词 4:信息图/知识海报
帮我做一张知识科普信息图,主题是"AI大模型发展时间线"。

内容要点:
1. 2017年:Transformer论文发布
2. 2020年:GPT-3发布
3. 2022年:ChatGPT发布
4. 2023年:多模态模型爆发
5. 2024年:Agent能力突破

要求:
1. 竖版海报,时间线从下到上
2. 每个节点配图标和简短说明
3. 科技感配色,深色背景+霓虹光效

七、适用场景与边界

适合使用的场景:

从零生成商业/社交媒体创意图片(封面、海报、Banner、主图等)
系列延展、多比例适配(一套物料多平台分发)
基于已有素材的编辑、换背景、换风格、局部替换
品牌视觉系统搭建(Logo→IP→包装→品牌应用全链路)
信息图、数据可视化、知识科普海报、流程图

不适合的场景:

视频生成:这是图片设计技能,不做视频
纯文字创作:不写文案、不写文章、不做PPT(除非是图片形式的PPT页面)
要求实际发布/排期:只生成图片,不执行发布动作

八、避坑提醒

避坑提醒
1
不要跳过产物路由直接说"帮我做张图"。越具体的产物类型描述,出图越专业。说"小红书封面"比说"做张图"效果好10倍。
2
事实性文字必须给出真实文案。标题、日期、价格、品牌名等核心文字要明确写出,不要用"XX""某某"等占位符,AI不会帮你编。
3
批量生成时先做核心资产再延展。不要一上来就要10张图,先做1张核心资产确认风格,再基于它延展系列图,一致性才有保障。
4
5.0 Pro不是"更好",而是"更轻"。5.0 Pro适合方向性构图决策和PE扩写,4.5适合详细多维度推演。根据需求选择,不是越新越好。
5
不要在prompt里写平台名和用途说明。"小红书封面""抖音风"这类词要转译为视觉风格、构图和信息密度,不要直接写进prompt。

九、一句话收个尾

AI出图的终极境界不是"提示词写得好",而是"用对了系统"。「创意设计」技能把专业设计师的工作流程——需求分析→产物定位→风格探索→核心资产→系列延展——固化成了可复用的系统,让每个人都能做出专业级的视觉物料。

作者声明:本作品含 AI 生成内容