
探索创意生产的自动化
C端视觉需求具有显著的产品化与定制化特征,业务诉求零散且体量大,传统模板化AI设计路径难以兼顾效率与质量。模型调用不稳定、输出不规范、人工介入成本高,是当前C端视觉生产的主要瓶颈。
基于上述问题,我们以Vibe Coding为主要开发方式,搭建了一套面向C端业务的AI生图Skill工作流平台,旨在将需求解析、模型调度、生图迭代、物料输出全链路自动化。
在业务场景下,希望通过自动化工作流,把那些低价值感、重复性的需求从设计师的待办清单中剥离出来,从而释放设计师的精力,让他们聚焦于更有创意、更有价值的核心项目。
此外,也能给业务提供一个低门槛的设计DIY平台,解决日常临时紧急的设计需求场景,让业务运营更加高效敏捷。

#02 架构设计
构建敏捷的工作流
我们首先搭建了平台的骨架,一个可共建、闭环运转的工作流体系。平台整体架构围绕三个核心环节展开:
需求解析分流:将业务输入(截图/PRD/描述文本等)后台进行需求的判断分析,调用最合适的模型及工作流承接;
高效生图与自动迭代:调用集团AI生图基建能力,配合质量审核与案例入库机制,实现生图路径优化;
低成本使用:规范输出文件后,通过钉钉机器人等无感交互方式,将工具嵌入现有工作流。

#03 核心能力
多元创意的从容表达
01 智能Prompt润色
借鉴Vibe design的设计思路,对于用户输入简要的需求描述,系统根据历史上下文的生图经验,自动解析业务诉求并生成结构化Prompt,将设计师最耗时的“需求翻译”环节前置自动化,智能转化为结构化的优质Prompt,减少人工撰写成本,使生图过程从依赖经验抽卡转变为可预期的标准化输出,能显著提升生图质量的稳定性。


02 Vibe/Master 双模式
针对专业设计师、业务方两类核心使用人群做差异化设计,提升双方创意生产的效率及体验,不同角色、不同场景可在同一平台内无缝切换。

Vibe模式:支持快速出图与创意探索,适合运营、产品等非设计专业人员,仅凭一句话或需求截图即可生成氛围感完整的效果图。
Master模式:提供精细化控制与深度调优,适合专业设计师调用,生图前期可多维度调控各类预设参数,生图后预留充足二次编辑空间,兼顾轻量化快速出图与专业高精度创作需求。

03 高级材质风格库
面对不同项目类型视觉风格的差异性,我们根据日常项目的高频使用场景进行提炼,预设多套材质与风格预设,可以高效选择目标材质、风格进行创意生图,无需每次需求进行重新的风格描述、上传风格参考图等操作,提升生图效率的同时,也增强了项目视觉风格的稳定性。

针对需要生成的主体元素,可在预设的10+材质库中,选择需要的材质,并进行材质质感强度的微调控制,解决了人工反复录入不同参考素材和prompt的撰写成本,实现快速且高质量的输出。


针对需要生成的画面,可在预设的10+风格库中,选择需要的视觉风格,快速测试不同主视觉风格的效果,非常适合新项目前期的创意探索。

04 精细化二次编辑
对于生图后,局部细节不满意的情况,提供多项快捷修改指令与自然语言驱动的局部修改,如智能高清、等比扩图、背景抠图、智能调色等,部分设计点位还提供psd格式的文件下载,让设计的品质再上一个台阶。


05 全链路高效拓展
除了解决单点的设计点位,针对一图多端的设计需求,也可以进行规范的预设,基于一版设计方案进行多个端不同规范的快速拓展输出,颠覆了传统依次适配多个拓展的设计方式。

#04 实战应用
驱动业务高效落地
01 自由创意生图
对于非标准规范的设计需求,提供自由创意生图的能力,如创意发散、主视觉探索、配图素材、效果图等场景,可以通过平台内丰富的高级材质风格预设库,进行高效的创意探索。
在正式生图前,平台工作流除了会对prompt进行智能的润色,还支持一次生成多个不同风格,在项目前期,适合快速探索视觉创意及风格的可能性。
02 业务定制工作流生图
针对运营侧重复量大、定制换肤、含 UI 展示等卡片生图诉求,结合业务内容规范高度定制化搭建专属生图管线——从创意输入、AI 生图、渲染合成到切图输出、内容审核,全链路一键化完成,降低业务抽卡、调图的人力成本。
工作流输出的文件可以实现分成多个定制化切片,下载时直接打包为一个文件夹(如输出尺寸精确背景图、logo切片、色值等素材),业务侧可以直接进行精确的配置。这种方式较好的解决了产品需求中,产品化程度较高的视觉配置需求。

Prompt 工程层:每种卡片有独立的 prompt 模板体系,支持 3 风格并行生成,运营从中选择最满意的一版。闪购骑士 IP 通过详细的角色描述 + 参考图注入 prompt,控制 AI 输出一致的品牌形象(头盔、护目镜、竹蜻蜓、身体比例都有精确约束)。不同场景下自动追加负面约束("不要出现文字/水印/logo/边框"),避免 AI 乱加元素。
场景风格引擎(弹窗为例):场景风格引擎:三维参数矩阵——10 种人群 × 11 种场景 × 3 种视觉层级,覆盖 330+ 种差异化 prompt 组合,运营只需选择三种标签,prompt 自动匹配。
渲染合成层:AI 原始图 → 品牌色渐变 → logo/文案/标签叠加 → 圆角裁切,每层独立渲染。文字采用 3x 超采样 + 错切旋转 + LANCZOS 缩放,消除变换毛边。
#05 总结展望
推动审美与功能
的持续进化
依据实测项目统计,大部分单图类需求处理时间从原先的2-3小时压缩至3-5分钟以内。平台内置质量审核、案例入库与偏好分析闭环,优质生图结果持续反哺Prompt生成器,使工具在使用过程中逐步对齐业务审美偏好。
本次实践的核心价值不在于单点技术突破,而在于构建了一个可持续的“业务-设计-技术”三方协同机制:
业务输入产品诉求,同时低门槛参与设计物料的共创
UED定义规则与审美标准,设计师封装Skill模块并沉淀知识库
平台承担设计体量的高效执行与学习职能
这是一次将C端视觉生产从人力密集型流程,重构为业务驱动型智能流水线的尝试。后续将在创意的精细化功能扩展与业务场景覆盖方向上持续迭代。

