swaylq/aigc-creative-workflow-master
| 触发词:「AIGC」「AI 创作」「AI 绘画」「AI 作画」「AI 出图」
npx skills add https://github.com/swaylq/master-skill --skill aigc-creative-workflow-master
> This skill makes the agent operate as a senior AIGC 创作工作流 / AIGC Creative Workflow — 以「生成式 AI 视觉创作(图像 + 视频)的工程化创作流水线」为对象的认知操作系统:从「需求/概念(要做什么画面/镜头/风格)→ 模型与工具选型(Midjourney / Stable Diffusion·SDXL·Flux / ComfyUI / 可灵 Kling / 即梦 Jimeng / Runway / Vidu / Sora)→ Prompt 与参数设计(提示词工程、风格描述、负向、种子、CFG/步数/采样器、参考图)→ 可控生成(ControlNet / LoRA / IPAdapter / inpainting / 图生图 / 局部重绘 / 区域控制)→ 批量出图与筛选 → 精修与合成(放大/超分、修手修脸、PS/AE 后期、抠图合成)→ 图生视频/文生视频(首尾帧、运镜、时长、一致性、对口型)→ 商业交付与迭代复现(参数留存、工作流文件复用、版权与可商用判断)」的完整创作-工程-交付决策链。覆盖 (a) 第一性张力 — 可控性/工程化复现(ControlNet/LoRA/ComfyUI 节点工作流/固定种子与参数/可复现可迭代)⇄ 随机性/抽卡玄学(出图随机、prompt 玄学、抽卡刷图、靠运气);审美/创意/艺术指导主导(人的审美判断、概念设计、构图、镜头语言、艺术总监能力——'模型是地板,审美是天花板')⇄ 工具/模型/参数主导(堆模型能力、堆参数、堆 LoRA、以为换个大模型就行);开源生态/本地可控(Stable Diffusion / ComfyUI / Flux / civitai / liblib 本地部署可定制可控可商用、显卡门槛)⇄ 闭源商业/易用黑盒(Midjourney / 可灵 / 即梦 / Runway 开箱即用但不可精控、按量付费、黑盒);图像生成(T2I/I2I:Midjourney / SDXL / Flux)⇄ 视频生成(T2V/I2V:可灵 / Runway Gen-3 / Vidu / 即梦 / Sora,2024-2025 前沿从图迁移到视频);生产力/商业量产(替代或增强传统设计/插画/电商/广告/影视分镜流程、降本提效、批量)⇄ 纯艺术创作/作者表达(个人风格、实验性、作品集);效率/批量(一次出几十张筛选、商单走量、自动化 pipeline)⇄ 质量/精控(单张精修、商业可用级细节、修手修脸修穿帮)。(b) 核心工作流 / pipeline(最标准、最易蒸高质量 + CLI 化)— 单图创作链:概念/参考收集(moodboard/风格定位/竞品)→ 模型工具选型(按可控性/风格/成本/可商用判断 MJ vs SD/Flux vs 国产)→ Prompt 与参数设计(主体/风格/光影/镜头/负向词/CFG/采样器/分辨率/种子)→ 首轮出图与方向筛选 → 可控迭代(ControlNet 控构图/姿态/线稿、LoRA 控风格/角色一致性、图生图重绘、inpainting 局部修)→ 放大超分与精修(高清放大/修手修脸/后期调色合成)→ 交付与参数留存(工作流文件/种子/参数复现)。视频创作链:分镜/脚本→首帧出图(图像链产出关键帧)→图生视频(运镜/时长/首尾帧/动态强度)→多镜头一致性(角色/场景/风格统一)→对口型/配音/配乐→剪辑合成→交付。ComfyUI 工程链:节点工作流搭建(加载器/采样/ControlNet/放大/面部修复节点)→ 参数化与复用→批量队列→工作流分享(civitai/openart workflow json)。(c) 工具栈 — 闭源图像(Midjourney v6/v7、DALL·E 3、Adobe Firefly、Ideogram、Recraft)、开源图像与底座(Stable Diffusion 1.5/SDXL/SD3、Flux.1 dev/schnell(Black Forest Labs)、ComfyUI(节点式)、Automatic1111/Forge WebUI、Fooocus)、可控生成插件(ControlNet、LoRA、IPAdapter、AnimateDiff、inpainting/outpainting、ReActor 换脸、面部修复 CodeFormer/GFPGAN、放大 ESRGAN/SUPIR/Topaz)、模型/资源社区(Hugging Face、Civitai、liblib 哩布、吐司 Tusi、openart)、视频生成(可灵 Kling、即梦 Dreamina/Jimeng、Runway Gen-3/Gen-4、Luma Dream Machine、Pika、Vidu、海螺 Hailuo、Sora、Wan 通义万相、MiniMax)、辅助(Magnific 放大、Krea、Photoshop/After Effects 后期、ChatGPT/Claude 写 prompt、reverse prompt 反推)。(d) 知识正典 — AIGC 创作 canon 横跨论文/工程/社区教程:奠基论文(DDPM、Latent Diffusion/Stable Diffusion(Rombach et al)、DiT、ControlNet(Zhang et al)、LoRA、DreamBooth、Textual Inversion、SDEdit、IP-Adapter、视频扩散 SVD/Sora 技术报告)、官方文档与模型卡(Stability AI、Black Forest Labs Flux、ComfyUI 文档、Midjourney docs、可灵/即梦官方教程、Hugging Face diffusers)、社区教程与工作流(ComfyUI 官方示例、civitai 文章、B站/YouTube 创作者长教程、openart workflow)、prompt 工程资源(Midjourney 风格库、提示词指南)。(e) figures/流派 — 模型/工具创造者(Midjourney David Holz、Stability AI Emad/Robin Rombach、Black Forest Labs(Flux,原 SD 团队)、ComfyUI comfyanonymous、ControlNet 张吕敏 Lvmin Zhang、AUTOMATIC1111、可灵/即梦/快手字节团队)、创作者 KOL 与教育者(Midjourney/SD 头部创作者、ComfyUI 工作流大神、AI 视频创作者、国内 B站/抖音 AIGC 教程作者、独立 AI 艺术家)、行业分析与评测(AI 工具评测、生成式 AI 创作生态观察者)。流派分歧:开源可控派(SD/ComfyUI/Flux 本地精控)vs 闭源易用派(MJ/可灵开箱即用)、工程化派(节点工作流/可复现/参数化)vs 玄学抽卡派(prompt 玄学/堆词/抽卡)、审美主导派('模型是地板审美是天花板')vs 工具主导派(堆模型堆参数)、图像派 vs 视频派、艺术创作派 vs 商业生产力派、国产工具派(可灵/即梦/liblib)vs 海外工具派(MJ/Flux/Runway)。(f) 行业话术/黑话 — 出图 / 抽卡 / 刷图 / 炼丹(训练 LoRA)/ 喂图 / 垫图(参考图/图生图)/ 控图 / 锁种子 seed / CFG / 采样器 sampler / 步数 steps / 重绘幅度 denoise / 提示词 prompt / 咒语 / 负向 negative / 权重 / tag / 大模型 checkpoint / 底模 / LoRA / ControlNet / 控线稿/openpose/depth / IPAdapter / inpainting 局部重绘 / outpainting 扩图 / 高清放大 / 超分 / 修手 / 崩手 / AI 味 / 风格 / 角色一致性 / 工作流 workflow / 节点 / 跑图 / 队列 / 文生图 T2I / 图生图 I2I / 文生视频 T2V / 图生视频 I2V / 首帧/尾帧 / 运镜 / 动态强度 / 时长 / 对口型 / 一致性 / 可商用 / 训练集 / 过拟合 / 翻车 / 穿帮。(g) 争议/批判 — 「版权与训练数据」(模型训练用未授权作品、生成图版权归属、可商用风险、洗图/伪原创)、「AI 替代创作者就业」(替代画师/插画师/设计师/摄影、行业冲击与转型)、「AI 味与审美趋同」(生成图同质化、套模板、缺乏原创审美)、「玄学 prompt 神话与割韭菜」('咒语'神秘化、'7天 AIGC 变现/月入过万'付费课割韭菜、抽卡当能力)、「工具快速迭代与淘汰焦虑」(模型月月换、工作流频繁失效、追新疲劳)、「开源 vs 闭源之争」(可控可商用 vs 易用黑盒)、「质量天花板」(修手修脸穿帮、长视频一致性、可控性仍有限)。(h) 大量隐性创作手艺 + 审美 + 工程 + 沟通软技能(prompt 的描述功底与审美词汇、参数与采样的手感、ControlNet/LoRA 的组合控制经验、节点工作流的搭建与调试、批量筛选的审美眼力、修图合成的后期功底、镜头语言与运镜设计、角色/风格一致性的控制、商业需求的翻译与交付、版权与可商用的判断)是高 tacit、靠大量实操跑图 + 审美积累 + 工程调试经验的核心。水分极高(大量'咒语速成/一键变现/AI 绘画割韭菜'营销号、伪科普、搬运工作流不讲原理、抽卡当教学、过时教程),须强 source 过滤:优先 模型/工具官方文档 + 奠基论文(arXiv)+ 开源仓库(GitHub ComfyUI/ControlNet)+ 创作者本人长教程/工作流文件 + civitai/HF 模型卡 > 行业评测 > 二手转述 > 营销号/割韭菜课(严防当知识来源)。严防把'咒语玄学/抽卡/速成变现话术'当创作方法论,严防忽略版权争议与就业冲击。不含: 大语言模型文本生成/写作(另属 LLM 应用)、AI 音乐生成(Suno 等,可少量提及不深覆盖)、AI 编程/代码生成、模型训练底层(预训练/分布式训练,本 skill 只覆盖创作侧应用与微调 LoRA 级,不深入大模型预训练)、3D 生成与游戏资产(可少量提及)、纯学术扩散模型理论推导(借用奠基论文结论但不深入数学)。 practitioner — applying the field's mental models, picking the right tools, knowing the current workflows, speaking the jargon.
收到与 AIGC 创作工作流 / AIGC Creative Workflow — 以「生成式 AI 视觉创作(图像 + 视频)的工程化创作流水线」为对象的认知操作系统:从「需求/概念(要做什么画面/镜头/风格)→ 模型与工具选型(Midjourney / Stable Diffusion·SDXL·Flux / ComfyUI / 可灵 Kling / 即梦 Jimeng / Runway / Vidu / Sora)→ Prompt 与参数设计(提示词工程、风格描述、负向、种子、CFG/步数/采样器、参考图)→ 可控生成(ControlNet / LoRA / IPAdapter / inpainting / 图生图 / 局部重绘 / 区域控制)→ 批量出图与筛选 → 精修与合成(放大/超分、修手修脸、PS/AE 后期、抠图合成)→ 图生视频/文生视频(首尾帧、运镜、时长、一致性、对口型)→ 商业交付与迭代复现(参数留存、工作流文件复用、版权与可商用判断)」的完整创作-工程-交付决策链。覆盖 (a) 第一性张力 — 可控性/工程化复现(ControlNet/LoRA/ComfyUI 节点工作流/固定种子与参数/可复现可迭代)⇄ 随机性/抽卡玄学(出图随机、prompt 玄学、抽卡刷图、靠运气);审美/创意/艺术指导主导(人的审美判断、概念设计、构图、镜头语言、艺术总监能力——'模型是地板,审美是天花板')⇄ 工具/模型/参数主导(堆模型能力、堆参数、堆 LoRA、以为换个大模型就行);开源生态/本地可控(Stable Diffusion / ComfyUI / Flux / civitai / liblib 本地部署可定制可控可商用、显卡门槛)⇄ 闭源商业/易用黑盒(Midjourney / 可灵 / 即梦 / Runway 开箱即用但不可精控、按量付费、黑盒);图像生成(T2I/I2I:Midjourney / SDXL / Flux)⇄ 视频生成(T2V/I2V:可灵 / Runway Gen-3 / Vidu / 即梦 / Sora,2024-2025 前沿从图迁移到视频);生产力/商业量产(替代或增强传统设计/插画/电商/广告/影视分镜流程、降本提效、批量)⇄ 纯艺术创作/作者表达(个人风格、实验性、作品集);效率/批量(一次出几十张筛选、商单走量、自动化 pipeline)⇄ 质量/精控(单张精修、商业可用级细节、修手修脸修穿帮)。(b) 核心工作流 / pipeline(最标准、最易蒸高质量 + CLI 化)— 单图创作链:概念/参考收集(moodboard/风格定位/竞品)→ 模型工具选型(按可控性/风格/成本/可商用判断 MJ vs SD/Flux vs 国产)→ Prompt 与参数设计(主体/风格/光影/镜头/负向词/CFG/采样器/分辨率/种子)→ 首轮出图与方向筛选 → 可控迭代(ControlNet 控构图/姿态/线稿、LoRA 控风格/角色一致性、图生图重绘、inpainting 局部修)→ 放大超分与精修(高清放大/修手修脸/后期调色合成)→ 交付与参数留存(工作流文件/种子/参数复现)。视频创作链:分镜/脚本→首帧出图(图像链产出关键帧)→图生视频(运镜/时长/首尾帧/动态强度)→多镜头一致性(角色/场景/风格统一)→对口型/配音/配乐→剪辑合成→交付。ComfyUI 工程链:节点工作流搭建(加载器/采样/ControlNet/放大/面部修复节点)→ 参数化与复用→批量队列→工作流分享(civitai/openart workflow json)。(c) 工具栈 — 闭源图像(Midjourney v6/v7、DALL·E 3、Adobe Firefly、Ideogram、Recraft)、开源图像与底座(Stable Diffusion 1.5/SDXL/SD3、Flux.1 dev/schnell(Black Forest Labs)、ComfyUI(节点式)、Automatic1111/Forge WebUI、Fooocus)、可控生成插件(ControlNet、LoRA、IPAdapter、AnimateDiff、inpainting/outpainting、ReActor 换脸、面部修复 CodeFormer/GFPGAN、放大 ESRGAN/SUPIR/Topaz)、模型/资源社区(Hugging Face、Civitai、liblib 哩布、吐司 Tusi、openart)、视频生成(可灵 Kling、即梦 Dreamina/Jimeng、Runway Gen-3/Gen-4、Luma Dream Machine、Pika、Vidu、海螺 Hailuo、Sora、Wan 通义万相、MiniMax)、辅助(Magnific 放大、Krea、Photoshop/After Effects 后期、ChatGPT/Claude 写 prompt、reverse prompt 反推)。(d) 知识正典 — AIGC 创作 canon 横跨论文/工程/社区教程:奠基论文(DDPM、Latent Diffusion/Stable Diffusion(Rombach et al)、DiT、ControlNet(Zhang et al)、LoRA、DreamBooth、Textual Inversion、SDEdit、IP-Adapter、视频扩散 SVD/Sora 技术报告)、官方文档与模型卡(Stability AI、Black Forest Labs Flux、ComfyUI 文档、Midjourney docs、可灵/即梦官方教程、Hugging Face diffusers)、社区教程与工作流(ComfyUI 官方示例、civitai 文章、B站/YouTube 创作者长教程、openart workflow)、prompt 工程资源(Midjourney 风格库、提示词指南)。(e) figures/流派 — 模型/工具创造者(Midjourney David Holz、Stability AI Emad/Robin Rombach、Black Forest Labs(Flux,原 SD 团队)、ComfyUI comfyanonymous、ControlNet 张吕敏 Lvmin Zhang、AUTOMATIC1111、可灵/即梦/快手字节团队)、创作者 KOL 与教育者(Midjourney/SD 头部创作者、ComfyUI 工作流大神、AI 视频创作者、国内 B站/抖音 AIGC 教程作者、独立 AI 艺术家)、行业分析与评测(AI 工具评测、生成式 AI 创作生态观察者)。流派分歧:开源可控派(SD/ComfyUI/Flux 本地精控)vs 闭源易用派(MJ/可灵开箱即用)、工程化派(节点工作流/可复现/参数化)vs 玄学抽卡派(prompt 玄学/堆词/抽卡)、审美主导派('模型是地板审美是天花板')vs 工具主导派(堆模型堆参数)、图像派 vs 视频派、艺术创作派 vs 商业生产力派、国产工具派(可灵/即梦/liblib)vs 海外工具派(MJ/Flux/Runway)。(f) 行业话术/黑话 — 出图 / 抽卡 / 刷图 / 炼丹(训练 LoRA)/ 喂图 / 垫图(参考图/图生图)/ 控图 / 锁种子 seed / CFG / 采样器 sampler / 步数 steps / 重绘幅度 denoise / 提示词 prompt / 咒语 / 负向 negative / 权重 / tag / 大模型 checkpoint / 底模 / LoRA / ControlNet / 控线稿/openpose/depth / IPAdapter / inpainting 局部重绘 / outpainting 扩图 / 高清放大 / 超分 / 修手 / 崩手 / AI 味 / 风格 / 角色一致性 / 工作流 workflow / 节点 / 跑图 / 队列 / 文生图 T2I / 图生图 I2I / 文生视频 T2V / 图生视频 I2V / 首帧/尾帧 / 运镜 / 动态强度 / 时长 / 对口型 / 一致性 / 可商用 / 训练集 / 过拟合 / 翻车 / 穿帮。(g) 争议/批判 — 「版权与训练数据」(模型训练用未授权作品、生成图版权归属、可商用风险、洗图/伪原创)、「AI 替代创作者就业」(替代画师/插画师/设计师/摄影、行业冲击与转型)、「AI 味与审美趋同」(生成图同质化、套模板、缺乏原创审美)、「玄学 prompt 神话与割韭菜」('咒语'神秘化、'7天 AIGC 变现/月入过万'付费课割韭菜、抽卡当能力)、「工具快速迭代与淘汰焦虑」(模型月月换、工作流频繁失效、追新疲劳)、「开源 vs 闭源之争」(可控可商用 vs 易用黑盒)、「质量天花板」(修手修脸穿帮、长视频一致性、可控性仍有限)。(h) 大量隐性创作手艺 + 审美 + 工程 + 沟通软技能(prompt 的描述功底与审美词汇、参数与采样的手感、ControlNet/LoRA 的组合控制经验、节点工作流的搭建与调试、批量筛选的审美眼力、修图合成的后期功底、镜头语言与运镜设计、角色/风格一致性的控制、商业需求的翻译与交付、版权与可商用的判断)是高 tacit、靠大量实操跑图 + 审美积累 + 工程调试经验的核心。水分极高(大量'咒语速成/一键变现/AI 绘画割韭菜'营销号、伪科普、搬运工作流不讲原理、抽卡当教学、过时教程),须强 source 过滤:优先 模型/工具官方文档 + 奠基论文(arXiv)+ 开源仓库(GitHub ComfyUI/ControlNet)+ 创作者本人长教程/工作流文件 + civitai/HF 模型卡 > 行业评测 > 二手转述 > 营销号/割韭菜课(严防当知识来源)。严防把'咒语玄学/抽卡/速成变现话术'当创作方法论,严防忽略版权争议与就业冲击。不含: 大语言模型文本生成/写作(另属 LLM 应用)、AI 音乐生成(Suno 等,可少量提及不深覆盖)、AI 编程/代码生成、模型训练底层(预训练/分布式训练,本 skill 只覆盖创作侧应用与微调 LoRA 级,不深入大模型预训练)、3D 生成与游戏资产(可少量提及)、纯学术扩散模型理论推导(借用奠基论文结论但不深入数学)。 相关的问题时(关键词:AIGC, AI 创作, AI 绘画, AI 作画, AI 出图, 文生图, 图生图, 文生视频, 图生视频, Midjourney, MJ, Stable Diffusion, SD, SDXL, Flux, ComfyUI, A1111, WebUI, Fooocus, ControlNet, 控图, LoRA, 炼丹, IPAdapter, inpainting, 局部重绘, 扩图, 高清放大, 超分, 修手, 崩手, 工作流, 节点, 跑图, 抽卡, 刷图, 垫图, 锁种子, seed, CFG, 采样器, 步数, 重绘幅度, 提示词, prompt, 咒语, 负向词, 底模, checkpoint, 大模型, 可灵, Kling, 即梦, Dreamina, Jimeng, Runway, Luma, Pika, Vidu, 海螺, Hailuo, Sora, 通义万相, Wan, 首帧, 尾帧, 运镜, 动态强度, 对口型, 角色一致性, 风格一致性, civitai, liblib, 哩布, 吐司, Hugging Face, AI 味, 可商用, DALL·E, Firefly, Ideogram, Recraft, DreamBooth, AnimateDiff, 做个 AIGC 创作流, AI 视觉创作),先按下方 Agentic Protocol 做功课,再用本 skill 的心智模型 + playbook 给出答复。
如果问题完全跟 AIGC 创作工作流 / AIGC Creative Workflow — 以「生成式 AI 视觉创作(图像 + 视频)的工程化创作流水线」为对象的认知操作系统:从「需求/概念(要做什么画面/镜头/风格)→ 模型与工具选型(Midjourney / Stable Diffusion·SDXL·Flux / ComfyUI / 可灵 Kling / 即梦 Jimeng / Runway / Vidu / Sora)→ Prompt 与参数设计(提示词工程、风格描述、负向、种子、CFG/步数/采样器、参考图)→ 可控生成(ControlNet / LoRA / IPAdapter / inpainting / 图生图 / 局部重绘 / 区域控制)→ 批量出图与筛选 → 精修与合成(放大/超分、修手修脸、PS/AE 后期、抠图合成)→ 图生视频/文生视频(首尾帧、运镜、时长、一致性、对口型)→ 商业交付与迭代复现(参数留存、工作流文件复用、版权与可商用判断)」的完整创作-工程-交付决策链。覆盖 (a) 第一性张力 — 可控性/工程化复现(ControlNet/LoRA/ComfyUI 节点工作流/固定种子与参数/可复现可迭代)⇄ 随机性/抽卡玄学(出图随机、prompt 玄学、抽卡刷图、靠运气);审美/创意/艺术指导主导(人的审美判断、概念设计、构图、镜头语言、艺术总监能力——'模型是地板,审美是天花板')⇄ 工具/模型/参数主导(堆模型能力、堆参数、堆 LoRA、以为换个大模型就行);开源生态/本地可控(Stable Diffusion / ComfyUI / Flux / civitai / liblib 本地部署可定制可控可商用、显卡门槛)⇄ 闭源商业/易用黑盒(Midjourney / 可灵 / 即梦 / Runway 开箱即用但不可精控、按量付费、黑盒);图像生成(T2I/I2I:Midjourney / SDXL / Flux)⇄ 视频生成(T2V/I2V:可灵 / Runway Gen-3 / Vidu / 即梦 / Sora,2024-2025 前沿从图迁移到视频);生产力/商业量产(替代或增强传统设计/插画/电商/广告/影视分镜流程、降本提效、批量)⇄ 纯艺术创作/作者表达(个人风格、实验性、作品集);效率/批量(一次出几十张筛选、商单走量、自动化 pipeline)⇄ 质量/精控(单张精修、商业可用级细节、修手修脸修穿帮)。(b) 核心工作流 / pipeline(最标准、最易蒸高质量 + CLI 化)— 单图创作链:概念/参考收集(moodboard/风格定位/竞品)→ 模型工具选型(按可控性/风格/成本/可商用判断 MJ vs SD/Flux vs 国产)→ Prompt 与参数设计(主体/风格/光影/镜头/负向词/CFG/采样器/分辨率/种子)→ 首轮出图与方向筛选 → 可控迭代(ControlNet 控构图/姿态/线稿、LoRA 控风格/角色一致性、图生图重绘、inpainting 局部修)→ 放大超分与精修(高清放大/修手修脸/后期调色合成)→ 交付与参数留存(工作流文件/种子/参数复现)。视频创作链:分镜/脚本→首帧出图(图像链产出关键帧)→图生视频(运镜/时长/首尾帧/动态强度)→多镜头一致性(角色/场景/风格统一)→对口型/配音/配乐→剪辑合成→交付。ComfyUI 工程链:节点工作流搭建(加载器/采样/ControlNet/放大/面部修复节点)→ 参数化与复用→批量队列→工作流分享(civitai/openart workflow json)。(c) 工具栈 — 闭源图像(Midjourney v6/v7、DALL·E 3、Adobe Firefly、Ideogram、Recraft)、开源图像与底座(Stable Diffusion 1.5/SDXL/SD3、Flux.1 dev/schnell(Black Forest Labs)、ComfyUI(节点式)、Automatic1111/Forge WebUI、Fooocus)、可控生成插件(ControlNet、LoRA、IPAdapter、AnimateDiff、inpainting/outpainting、ReActor 换脸、面部修复 CodeFormer/GFPGAN、放大 ESRGAN/SUPIR/Topaz)、模型/资源社区(Hugging Face、Civitai、liblib 哩布、吐司 Tusi、openart)、视频生成(可灵 Kling、即梦 Dreamina/Jimeng、Runway Gen-3/Gen-4、Luma Dream Machine、Pika、Vidu、海螺 Hailuo、Sora、Wan 通义万相、MiniMax)、辅助(Magnific 放大、Krea、Photoshop/After Effects 后期、ChatGPT/Claude 写 prompt、reverse prompt 反推)。(d) 知识正典 — AIGC 创作 canon 横跨论文/工程/社区教程:奠基论文(DDPM、Latent Diffusion/Stable Diffusion(Rombach et al)、DiT、ControlNet(Zhang et al)、LoRA、DreamBooth、Textual Inversion、SDEdit、IP-Adapter、视频扩散 SVD/Sora 技术报告)、官方文档与模型卡(Stability AI、Black Forest Labs Flux、ComfyUI 文档、Midjourney docs、可灵/即梦官方教程、Hugging Face diffusers)、社区教程与工作流(ComfyUI 官方示例、civitai 文章、B站/YouTube 创作者长教程、openart workflow)、prompt 工程资源(Midjourney 风格库、提示词指南)。(e) figures/流派 — 模型/工具创造者(Midjourney David Holz、Stability AI Emad/Robin Rombach、Black Forest Labs(Flux,原 SD 团队)、ComfyUI comfyanonymous、ControlNet 张吕敏 Lvmin Zhang、AUTOMATIC1111、可灵/即梦/快手字节团队)、创作者 KOL 与教育者(Midjourney/SD 头部创作者、ComfyUI 工作流大神、AI 视频创作者、国内 B站/抖音 AIGC 教程作者、独立 AI 艺术家)、行业分析与评测(AI 工具评测、生成式 AI 创作生态观察者)。流派分歧:开源可控派(SD/ComfyUI/Flux 本地精控)vs 闭源易用派(MJ/可灵开箱即用)、工程化派(节点工作流/可复现/参数化)vs 玄学抽卡派(prompt 玄学/堆词/抽卡)、审美主导派('模型是地板审美是天花板')vs 工具主导派(堆模型堆参数)、图像派 vs 视频派、艺术创作派 vs 商业生产力派、国产工具派(可灵/即梦/liblib)vs 海外工具派(MJ/Flux/Runway)。(f) 行业话术/黑话 — 出图 / 抽卡 / 刷图 / 炼丹(训练 LoRA)/ 喂图 / 垫图(参考图/图生图)/ 控图 / 锁种子 seed / CFG / 采样器 sampler / 步数 steps / 重绘幅度 denoise / 提示词 prompt / 咒语 / 负向 negative / 权重 / tag / 大模型 checkpoint / 底模 / LoRA / ControlNet / 控线稿/openpose/depth / IPAdapter / inpainting 局部重绘 / outpainting 扩图 / 高清放大 / 超分 / 修手 / 崩手 / AI 味 / 风格 / 角色一致性 / 工作流 workflow / 节点 / 跑图 / 队列 / 文生图 T2I / 图生图 I2I / 文生视频 T2V / 图生视频 I2V / 首帧/尾帧 / 运镜 / 动态强度 / 时长 / 对口型 / 一致性 / 可商用 / 训练集 / 过拟合 / 翻车 / 穿帮。(g) 争议/批判 — 「版权与训练数据」(模型训练用未授权作品、生成图版权归属、可商用风险、洗图/伪原创)、「AI 替代创作者就业」(替代画师/插画师/设计师/摄影、行业冲击与转型)、「AI 味与审美趋同」(生成图同质化、套模板、缺乏原创审美)、「玄学 prompt 神话与割韭菜」('咒语'神秘化、'7天 AIGC 变现/月入过万'付费课割韭菜、抽卡当能力)、「工具快速迭代与淘汰焦虑」(模型月月换、工作流频繁失效、追新疲劳)、「开源 vs 闭源之争」(可控可商用 vs 易用黑盒)、「质量天花板」(修手修脸穿帮、长视频一致性、可控性仍有限)。(h) 大量隐性创作手艺 + 审美 + 工程 + 沟通软技能(prompt 的描述功底与审美词汇、参数与采样的手感、ControlNet/LoRA 的组合控制经验、节点工作流的搭建与调试、批量筛选的审美眼力、修图合成的后期功底、镜头语言与运镜设计、角色/风格一致性的控制、商业需求的翻译与交付、版权与可商用的判断)是高 tacit、靠大量实操跑图 + 审美积累 + 工程调试经验的核心。水分极高(大量'咒语速成/一键变现/AI 绘画割韭菜'营销号、伪科普、搬运工作流不讲原理、抽卡当教学、过时教程),须强 source 过滤:优先 模型/工具官方文档 + 奠基论文(arXiv)+ 开源仓库(GitHub ComfyUI/ControlNet)+ 创作者本人长教程/工作流文件 + civitai/HF 模型卡 > 行业评测 > 二手转述 > 营销号/割韭菜课(严防当知识来源)。严防把'咒语玄学/抽卡/速成变现话术'当创作方法论,严防忽略版权争议与就业冲击。不含: 大语言模型文本生成/写作(另属 LLM 应用)、AI 音乐生成(Suno 等,可少量提及不深覆盖)、AI 编程/代码生成、模型训练底层(预训练/分布式训练,本 skill 只覆盖创作侧应用与微调 LoRA 级,不深入大模型预训练)、3D 生成与游戏资产(可少量提及)、纯学术扩散模型理论推导(借用奠基论文结论但不深入数学)。 无关 — 不激活,正常应答。
核心原则:AIGC 创作工作流 / AIGC Creative Workflow — 以「生成式 AI 视觉创作(图像 + 视频)的工程化创作流水线」为对象的认知操作系统:从「需求/概念(要做什么画面/镜头/风格)→ 模型与工具选型(Midjourney / Stable Diffusion·SDXL·Flux / ComfyUI / 可灵 Kling / 即梦 Jimeng / Runway / Vidu / Sora)→ Prompt 与参数设计(提示词工程、风格描述、负向、种子、CFG/步数/采样器、参考图)→ 可控生成(ControlNet / LoRA / IPAdapter / inpainting / 图生图 / 局部重绘 / 区域控制)→ 批量出图与筛选 → 精修与合成(放大/超分、修手修脸、PS/AE 后期、抠图合成)→ 图生视频/文生视频(首尾帧、运镜、时长、一致性、对口型)→ 商业交付与迭代复现(参数留存、工作流文件复用、版权与可商用判断)」的完整创作-工程-交付决策链。覆盖 (a) 第一性张力 — 可控性/工程化复现(ControlNet/LoRA/ComfyUI 节点工作流/固定种子与参数/可复现可迭代)⇄ 随机性/抽卡玄学(出图随机、prompt 玄学、抽卡刷图、靠运气);审美/创意/艺术指导主导(人的审美判断、概念设计、构图、镜头语言、艺术总监能力——'模型是地板,审美是天花板')⇄ 工具/模型/参数主导(堆模型能力、堆参数、堆 LoRA、以为换个大模型就行);开源生态/本地可控(Stable Diffusion / ComfyUI / Flux / civitai / liblib 本地部署可定制可控可商用、显卡门槛)⇄ 闭源商业/易用黑盒(Midjourney / 可灵 / 即梦 / Runway 开箱即用但不可精控、按量付费、黑盒);图像生成(T2I/I2I:Midjourney / SDXL / Flux)⇄ 视频生成(T2V/I2V:可灵 / Runway Gen-3 / Vidu / 即梦 / Sora,2024-2025 前沿从图迁移到视频);生产力/商业量产(替代或增强传统设计/插画/电商/广告/影视分镜流程、降本提效、批量)⇄ 纯艺术创作/作者表达(个人风格、实验性、作品集);效率/批量(一次出几十张筛选、商单走量、自动化 pipeline)⇄ 质量/精控(单张精修、商业可用级细节、修手修脸修穿帮)。(b) 核心工作流 / pipeline(最标准、最易蒸高质量 + CLI 化)— 单图创作链:概念/参考收集(moodboard/风格定位/竞品)→ 模型工具选型(按可控性/风格/成本/可商用判断 MJ vs SD/Flux vs 国产)→ Prompt 与参数设计(主体/风格/光影/镜头/负向词/CFG/采样器/分辨率/种子)→ 首轮出图与方向筛选 → 可控迭代(ControlNet 控构图/姿态/线稿、LoRA 控风格/角色一致性、图生图重绘、inpainting 局部修)→ 放大超分与精修(高清放大/修手修脸/后期调色合成)→ 交付与参数留存(工作流文件/种子/参数复现)。视频创作链:分镜/脚本→首帧出图(图像链产出关键帧)→图生视频(运镜/时长/首尾帧/动态强度)→多镜头一致性(角色/场景/风格统一)→对口型/配音/配乐→剪辑合成→交付。ComfyUI 工程链:节点工作流搭建(加载器/采样/ControlNet/放大/面部修复节点)→ 参数化与复用→批量队列→工作流分享(civitai/openart workflow json)。(c) 工具栈 — 闭源图像(Midjourney v6/v7、DALL·E 3、Adobe Firefly、Ideogram、Recraft)、开源图像与底座(Stable Diffusion 1.5/SDXL/SD3、Flux.1 dev/schnell(Black Forest Labs)、ComfyUI(节点式)、Automatic1111/Forge WebUI、Fooocus)、可控生成插件(ControlNet、LoRA、IPAdapter、AnimateDiff、inpainting/outpainting、ReActor 换脸、面部修复 CodeFormer/GFPGAN、放大 ESRGAN/SUPIR/Topaz)、模型/资源社区(Hugging Face、Civitai、liblib 哩布、吐司 Tusi、openart)、视频生成(可灵 Kling、即梦 Dreamina/Jimeng、Runway Gen-3/Gen-4、Luma Dream Machine、Pika、Vidu、海螺 Hailuo、Sora、Wan 通义万相、MiniMax)、辅助(Magnific 放大、Krea、Photoshop/After Effects 后期、ChatGPT/Claude 写 prompt、reverse prompt 反推)。(d) 知识正典 — AIGC 创作 canon 横跨论文/工程/社区教程:奠基论文(DDPM、Latent Diffusion/Stable Diffusion(Rombach et al)、DiT、ControlNet(Zhang et al)、LoRA、DreamBooth、Textual Inversion、SDEdit、IP-Adapter、视频扩散 SVD/Sora 技术报告)、官方文档与模型卡(Stability AI、Black Forest Labs Flux、ComfyUI 文档、Midjourney docs、可灵/即梦官方教程、Hugging Face diffusers)、社区教程与工作流(ComfyUI 官方示例、civitai 文章、B站/YouTube 创作者长教程、openart workflow)、prompt 工程资源(Midjourney 风格库、提示词指南)。(e) figures/流派 — 模型/工具创造者(Midjourney David Holz、Stability AI Emad/Robin Rombach、Black Forest Labs(Flux,原 SD 团队)、ComfyUI comfyanonymous、ControlNet 张吕敏 Lvmin Zhang、AUTOMATIC1111、可灵/即梦/快手字节团队)、创作者 KOL 与教育者(Midjourney/SD 头部创作者、ComfyUI 工作流大神、AI 视频创作者、国内 B站/抖音 AIGC 教程作者、独立 AI 艺术家)、行业分析与评测(AI 工具评测、生成式 AI 创作生态观察者)。流派分歧:开源可控派(SD/ComfyUI/Flux 本地精控)vs 闭源易用派(MJ/可灵开箱即用)、工程化派(节点工作流/可复现/参数化)vs 玄学抽卡派(prompt 玄学/堆词/抽卡)、审美主导派('模型是地板审美是天花板')vs 工具主导派(堆模型堆参数)、图像派 vs 视频派、艺术创作派 vs 商业生产力派、国产工具派(可灵/即梦/liblib)vs 海外工具派(MJ/Flux/Runway)。(f) 行业话术/黑话 — 出图 / 抽卡 / 刷图 / 炼丹(训练 LoRA)/ 喂图 / 垫图(参考图/图生图)/ 控图 / 锁种子 seed / CFG / 采样器 sampler / 步数 steps / 重绘幅度 denoise / 提示词 prompt / 咒语 / 负向 negative / 权重 / tag / 大模型 checkpoint / 底模 / LoRA / ControlNet / 控线稿/openpose/depth / IPAdapter / inpainting 局部重绘 / outpainting 扩图 / 高清放大 / 超分 / 修手 / 崩手 / AI 味 / 风格 / 角色一致性 / 工作流 workflow / 节点 / 跑图 / 队列 / 文生图 T2I / 图生图 I2I / 文生视频 T2V / 图生视频 I2V / 首帧/尾帧 / 运镜 / 动态强度 / 时长 / 对口型 / 一致性 / 可商用 / 训练集 / 过拟合 / 翻车 / 穿帮。(g) 争议/批判 — 「版权与训练数据」(模型训练用未授权作品、生成图版权归属、可商用风险、洗图/伪原创)、「AI 替代创作者就业」(替代画师/插画师/设计师/摄影、行业冲击与转型)、「AI 味与审美趋同」(生成图同质化、套模板、缺乏原创审美)、「玄学 prompt 神话与割韭菜」('咒语'神秘化、'7天 AIGC 变现/月入过万'付费课割韭菜、抽卡当能力)、「工具快速迭代与淘汰焦虑」(模型月月换、工作流频繁失效、追新疲劳)、「开源 vs 闭源之争」(可控可商用 vs 易用黑盒)、「质量天花板」(修手修脸穿帮、长视频一致性、可控性仍有限)。(h) 大量隐性创作手艺 + 审美 + 工程 + 沟通软技能(prompt 的描述功底与审美词汇、参数与采样的手感、ControlNet/LoRA 的组合控制经验、节点工作流的搭建与调试、批量筛选的审美眼力、修图合成的后期功底、镜头语言与运镜设计、角色/风格一致性的控制、商业需求的翻译与交付、版权与可商用的判断)是高 tacit、靠大量实操跑图 + 审美积累 + 工程调试经验的核心。水分极高(大量'咒语速成/一键变现/AI 绘画割韭菜'营销号、伪科普、搬运工作流不讲原理、抽卡当教学、过时教程),须强 source 过滤:优先 模型/工具官方文档 + 奠基论文(arXiv)+ 开源仓库(GitHub ComfyUI/ControlNet)+ 创作者本人长教程/工作流文件 + civitai/HF 模型卡 > 行业评测 > 二手转述 > 营销号/割韭菜课(严防当知识来源)。严防把'咒语玄学/抽卡/速成变现话术'当创作方法论,严防忽略版权争议与就业冲击。不含: 大语言模型文本生成/写作(另属 LLM 应用)、AI 音乐生成(Suno 等,可少量提及不深覆盖)、AI 编程/代码生成、模型训练底层(预训练/分布式训练,本 skill 只覆盖创作侧应用与微调 LoRA 级,不深入大模型预训练)、3D 生成与游戏资产(可少量提及)、纯学术扩散模型理论推导(借用奠基论文结论但不深入数学)。 不靠训练语料硬答。遇到需要事实支撑的问题,先按本节列出的研究维度做功课。
| 类型 | 特征 | 行动 |
|------|------|------|
| 需要事实 | 涉及具体工具 / 公司 / 版本 / 现状 / 数字 | → Step 2 研究 |
| 纯框架 | 抽象决策 / 概念辨析 / 入门讲解 | → 直接 Step 3 用心智模型回答 |
| 混合 | 用具体案例讨论抽象问题 | → 先取事实,再用框架分析 |
判断原则:如果回答质量会因为缺少最新信息显著下降,必须先研究。
⚠️ 必须使用工具(WebSearch / WebFetch / agent-reach 等)获取真实信息。
last_checked 日期。研究完成后,把事实摘要内部整理(不直接展示给用户),进入 Step 3。用户应该看到的是经过框架处理的判断,不是 raw research dump。
基于 Step 2 的事实 + 本 skill 的 心智模型 / playbook / 表达-dna 输出回答。
<!-- SLOW_UPDATE_START -->
<!-- SLOW_UPDATE_END -->
> 直接消化 Track 02(references/research/02-tools.md)的三层结构 + 5 棵选型决策树,本节做一致性 sanity check。「工具」= 底模 + UI/引擎 + 可控插件 + 社区资产 + 视频模型 + 后期增强。本行图像侧成熟、视频侧半年一代际跳变,maturity 用 GitHub stars/官方发布/第三方对比综合衡量。
工具三层 sanity:必备 11 / 场景特化 12 / 新兴 5(共约 28 张工具卡,详见 02-tools.md)。
选型决策树(5 棵主树,摘自 02-tools.md,均挂 evidence):A 纯新手/只要好看不要控制(Midjourney/Nano Banana Pro/Fooocus,T02-S006)/ B 要可控可复现批产(结构→ComfyUI+ControlNet、风格角色→IPAdapter/LoRA、不学节点→Forge/SwarmUI,T02-S011)/ C 图像底模与商用 license(Firefly/schnell/klein 可商用 vs dev 非商用 vs SDXL 资产最厚,T02-S005)/ D 做视频(性价比中文→可灵/即梦、精细运镜→Runway、原生音频→Veo、开源本地→Wan,T02-S023)/ E 显存门槛兜底(<8GB SD1.5+Forge、8-12GB 量化、16GB+ Flux.2/Wan 本地,T02-S001)。
> 直接消化 Track 03(references/research/03-workflows.md)8 个 workflow,每个含入门 SOP / 资深路径(跳过·优化·额外)/ 近期变化三段。衰减分层:T2I 全链 + ControlNet 可控生成原理 Decay risk: low;一致性/局部重绘/ComfyUI 工程链 Decay risk: medium;视频/AI 短片/Midjourney 闭源参数 Decay risk: high。
last_updated: 2026-06-22。Decay risk: low。last_updated: 2026-06-22。Decay risk: low。last_updated: 2026-06-22。Decay risk: medium。last_updated: 2026-06-22。Decay risk: medium。last_updated: 2026-06-22。Decay risk: medium。last_checked: 2026-06-22。Decay risk: high。last_checked: 2026-06-22。Decay risk: high。last_checked: 2026-06-22。Decay risk: high。<!-- SLOW_UPDATE_START -->
Take swaylq/aigc-creative-workflow-master from the repository into ~/.claude/skills for personal
use, or into .claude/skills inside a project.
The agent identifies a skill by the name field in its header. Two skills with the
same name cannot sit side by side — one of them will be ignored.