先记住三条结论

这套流程先记三句话就够。

第一:研究在提示词之前。 交付约束、批准过的身份参考、权利信息和事实要求,要在生成前收集。

第二:初稿分层解决。 先构图,再稳定身份;身份稳定后再做局部细节;最后才做交付级精修。不要在一个之后会被裁切推翻的决定上先花最贵的时间。

第三:审查证据,不只审查“感觉”。 每次批准最好都能指向简报、参考资料、事实来源、视觉测试或记录过的人工决定。“感觉更好了”当然可以是有价值的直觉,但它不是一份强生产记录。

下面的流程就是把这三条变成真正能执行的工作方法,同时避免把团队绑死在某一个模型上。

研究阶段:先定义这张图到底在表达哪种“真实”

在开始搜图之前,先决定这张资产到底承担什么真实性要求。

纯氛围插画可以自由发明建筑;历史复原图的负担完全不同;产品概念图如果细节尚未定稿,就需要清楚标注;放在电商规格旁边的产品图,更不能随手“幻觉”出接口、缝线、控制按钮或包装配件。

做一条“真实性条件”备注:

  • 纯虚构/插画;
  • 概念阶段,不代表最终产品;
  • 事实型产品呈现;
  • 编辑性复原;
  • 纪录性宣称;
  • 仅内部探索。

之后再按这一级别收集资料。事实型产品优先用批准规格与产品摄影;涉及文化或历史时,条件允许应追到可靠原始资料、博物馆或学术来源;原创IP则依赖受控的正式设定。

这一分类看似简单,却能提前消灭大量后期争论,因为团队终于知道:这张图只需要“看起来合理”,还是必须“尽可能准确”。

初稿阶段一:让构图尽可能便宜

最便宜的初稿并不是最好看的初稿。用粗生成、草图或块面先回答取景问题。

尽早测试比例和响应式裁切,把标题占位框、CTA区域直接压到Mockup上。如果资产同时服务英文和中文,不要对着一张想象中的空页面设计,而要给真实更长、更密的文字留下空间。

保留一张构图接触表,把淘汰方案和一句话原因记下来:“标题冲突”“手机裁切丢脸”“次要人物抢产品焦点”“地平线正好切过Logo”。

这些都是后面的证据。当合作方问为什么人物不居中,团队可以解释实际系统约束,而不是每次都从零重新打一场审美辩论。

初稿阶段二:把身份与结构稳定下来

构图选定以后,再定义身份锚点。人物可能包括脸部比例、发型轮廓、服装结构、关键道具和体型关系;产品则可能是尺寸、控制件位置、材质过渡和Logo位置。

不要只下“更一致”这种命令,要明确一致究竟指什么。

工具如果提供参考控制,就按当前官方文档有意识地使用。某些产品会把结构参考和风格参考分开,这两者解决的不是同一个问题,也不能假设在所有系统里行为完全一致。

一旦结果漂移,要明确选择:重新生成、局部编辑、把批准元素重新合成,还是干脆离开AI路径。流程成功的标准,是最后得到可控结果,而不是证明每一个像素都必须来自同一种技术。

审查阶段:依次过五道证据门

按顺序过五道门。

  1. **视觉层级:**第一眼最该赢的主体真的赢了吗?
  2. **身份/结构:**受控锚点与批准参考一致吗?
  3. **事实完整性:**画面细节符合前面定义的真实性条件吗?
  4. **权利与披露:**关键输入和计划用途是否落在团队依赖的许可与当前条款范围内?
  5. **交付/来源:**最终导出在真实环境能用吗?哪些来源与编辑信息可以准确对外传达?

第二道门失败时,通常就别急着在第五道门上抛光。按顺序处理能省掉大量返工。

在支持的工具链中,基于C2PA的Content Credentials可以成为第五道门的一部分,但它不能代替第三或第四道门。同样,法律审查也不会自动发现手部结构错误或手机裁切。每一道门回答的都是不同问题。

修改阶段:每次只处理一种错误类别

修改应该从“命名错误类型”开始,而不是再加一个氛围词。

例如:

  • 裁切失败;
  • 身份漂移;
  • 透视/接触错误;
  • 材质不一致;
  • 虚假的产品细节;
  • 文化语境问题;
  • 无证据支持的宣称;
  • 来源记录缺口。

每一次修改,都先写下能解决这类问题的最小干预。如果这个改动破坏了优先级更高的锚点,就回退。

这也自然产生停止规则。如果连续三次修改都是修好一个问题、同时弄坏另一个同等重要的问题,就应该比较换技术路线的成本。人工paint、矢量重画、3D、实拍或者重做概念,此时可能反而更便宜。

没有停止规则的流程可以无限吞噬生成时间,因为每一次“差一点”看起来都像只差最后一句提示词。

证据与例外:版权、工具和版本漂移

美国版权局当前的AI材料,对一个窄问题很有参考价值:在美国,版权保护分析依赖人类创作表达,单靠提示词并不会自动建立这种作者性。但这不是所有法域、所有权利问题的统一答案。

工具能力同样有条件。参考图控制、Content Credentials、模型行为和商业条款都会变化。所以流程文档最好记录当时依赖了哪个产品/版本或哪份当前文档,而不是把今天的界面直接写成永恒规则。

还有一个重要例外:低风险内部构思,不一定需要和国际付费活动同样厚的记录。流程应该与风险成比例。不能拿“只是头脑风暴”当上传机密或无权素材的借口,也没必要让每一张草图都背上企业级官僚流程。

好的治理应该是成比例、可记录、也能随新证据修改的。

一页纸就能承载的可复用模板

一个精简项目表就足以承载整套流程:

**资产用途:**出现在哪里、支持什么动作。
**真实性条件:**插画、概念、事实型产品、复原或纪录。
**不可漂移锚点:**三到五项。
**参考职责:**身份 / 结构 / 风格 / 材质 / 约束。
**当前轮次:**构图、身份、几何、材质、细节或交付。
**淘汰测试:**什么情况一出现就不能用。
**权利备注:**许可、机密输入、需要复核的当前条款。
**人工修改:**版式、遮罩、合成、paint、排版、选择。
**来源:**工具链记录了什么、它又不能证明什么。
**停止规则:**什么时候换技术路线。
**批准人:**谁真正有权关掉这个资产。

这样的结构对小团队已经足够,同时不会假装创作过程能够被彻底自动化。它之所以有用,是因为那些原本藏在脑子里的假设终于变成了别人能够检查的决定。

收参考图之前,先把“事实证据”和“视觉灵感”分开

研究资料夹不应该只是一个巨大的情绪板。先拆成两类:事实和视觉灵感。

事实是会约束真实性的材料,例如已批准的产品尺寸、正式人物设定、法定名称、历史资料、地区活动要求、强制警示和素材权限。视觉灵感负责探索可能性,例如灯光、节奏、色板、取景和纹理。

把两类东西混在一起,会制造非常昂贵的错误:一张氛围图被误当成产品规格;一张已经过期的活动视觉因为没人标“历史版本”而被继续复制;一张AI生成参考又被当成下一张AI图的事实证据。

给事实资料指定负责人和日期。只要事实要求变化,负责人就触发依赖图片复查。灵感资料可以更松,因为它的工作是制造选择,不是证明事实。

交付以后,也要审一次“流程本身”

资产上线后,再花十分钟做一次流程复盘:哪道门抓到了最昂贵的问题?哪张参考导致最多漂移?哪次人工修改最省时间?哪些记录最后根本没人用?

只保留真正会改变下次行为的经验。“下次提示词写好一点”太空泛;“双语网页Hero必须在身份精修前先锁文字区”可以复用;“不能再拿2025归档产品图当尺寸来源”则可以直接执行。

这一步才让流程真正变成“可复用”,而不只是“有文档”。它把一次项目里的意外,变成下一次项目的默认条件。

当然也不要把流程永远冻死。模型行为、产品条款、来源标准和活动风险都会变化,哪些地方值得设置审查门也会跟着变。真正稳定的原则,是让这些变化显式、有证据、可追踪。

批准必须是一个明确决定

流程最后留一条明确批准记录:谁批准、批准用于什么、日期是什么、还有哪些未解决限制。内部提案通过的版本,并不会自动变成付费广告也可用的版本。这一行小记录能防止下一次分发把从未获得的权限“继承”过去。

风险登记表能让创作速度变快,而不是盲目变快

保留一张很短的风险登记表,只需要五列:风险、发生可能性、后果、负责人、下一份证据。例如“参考图权限不清”“手机裁切未测”“产品概念图可能暗示尚未确定的功能”“付费活动前需要复核当前工具条款”。

表必须短到站会能读完。证据回来就关闭风险,不要为了形式把它永久留着。

这样团队可以一边解决某个明确不确定,一边继续推进其他低风险工作,而不是在“全部停工”和“假装风险不存在”之间二选一。

给流程里的每条重要规则标出来源

对高影响规则标明来源:当前产品文档、内部设计决定、客户政策、法律指导,还是某次真实失败。这样可以阻止圈内传说慢慢硬化成“公司流程”。

如果工具更新了参考控制,只需要复核依赖这份文档的规则;如果客户放宽裁切要求,也无需因此重新打开版权分析。

这种“规则来源”纪律让维护变得更容易,因为团队只更新依赖,而不是每次重写整个系统。

它还会暴露那些根本没有权威来源的句子——典型就是“我们一直都这么做”,但没人记得当初为什么。

Sources

Related Reading