# 工作流全景
## 1. 先定义最小可玩的内容
剧本主体、角色出场顺序、分支方向和需要的功能由作者先定。不要从“我要收集七个人所有模型”开始,而是从一段能走完的故事开始:场景、出场角色、普通路线、可选支线、结算和回读。
当前 H5 版本的代表机制是:角色普通路线结束后,玩家可以继续挑战下一位,或进入当前角色的“玩家战败”支线。分支出现时保存独立检查点,支线结束后能一键回到选择前。
## 2. 把剧本拆成资产合同
每个节点至少记录:
- 节点 ID 与角色 ID;
- 场景事件句;
- 台词与语言版本;
- CG 文件名/生成状态;
- 语音 ID、情绪与目标文件名;
- 分支类型、目标节点和解锁项;
- 需要的 SFX/BGM;
- 验收状态与已知问题。
这样提示词、图片、声音和代码不会只靠文件名猜关系。
## 3. 模型/素材来源先入账
从 Civitai、Tensor.Art、PixAI、Hugging Face 或其他来源发现模型时,先记作者页、版本、触发词、底模、推荐权重、许可、访问日期和本地文件名。模型可以放本机归档,但公开分享包只提供链接和清单。
早期部分检索与 SD 提示词草稿按作者自述由 Grok 协助。最终使用的文件仍需人工核对来源、版本和可复现参数;“AI 搜到了”不算许可证据。
## 4. 提示词与 CG
编号 Markdown 存每张图变化的动作/神态/分镜;工作流存底模、LoRA、负面词、采样器、分辨率和输出规则。GUI 或 ComfyUI 节点把两者结合,先生成小样,再批量入队。
每张图保留:prompt、negative、checkpoint、LoRA/权重、sampler、scheduler、steps、CFG、seed、分辨率、denoise、控制输入和输出文件名。
## 5. 声音
台词先进入需求表/JSON,而不是直接粘进终端。Qwen3-TTS 和 GPT-SoVITS 是两套独立 TTS;RVC 是可选音色转换。批处理生成 WAV 与 JSON 记录,之后做格式、时长、近静音、响度和映射检查,再由人听。
程序化 UI/SFX 使用源码生成,不依赖外部采样;其他 CC0/第三方 SFX 必须保留单独许可证和作者来源。
## 6. 接入与 UX
在游戏副本中接线,不覆盖原始 ZIP。绑定 CG、voice、emotion voice、SFX、语言包、存档和回想室。桌面和手机分别验证:1440 px 与 390 px 是本轮已有证据的两个宽度,不代表所有设备都已覆盖。
## 7. 三类验收必须分开
- 技术验收:代码、JSON、格式、路径、哈希、浏览器错误、ZIP CRC。
- 视觉/听感验收:构图、身份一致性、手尾接触、音色、咬字、情绪、响度体感。
- 发布验收:来源、许可、AI 披露、同人声明、无权重/参考音频误分发。
任何一类通过都不能替代另外两类。