AI 工作流

game-creator:把图片、视频与声音接进 Agent 工作流

从素材生成到任务恢复,介绍 game-creator 2.0 如何组织多媒体调用、文件校验与交付。

素材生成之后,工作还没结束

游戏原型和创意项目常常同时需要角色图、短视频、旁白与 BGM。接入生成接口只是第一步:请求有没有提交成功、文件能不能打开、任务中断后能不能继续,同样影响实际使用。

game-creator 把这些环节放进一套 Skill 和命令行工具。目前的 2.0 版本覆盖文生图、图生图、图片理解、文生视频、图生视频、语音与 BGM,便于 Agent 在同一工作流中调用。

一个入口,多种媒体协议

图片编辑、视频生成与语音接口并不共用一套请求格式。工具用适配器区分这些协议,例如图片编辑可选择网关 JSON 或标准 multipart edits,视频任务也需要匹配对应的适配器。

模型由用户配置,也可以用 --model 临时覆盖。工具不会把未知的视频模型一律当作某一种协议处理。能否使用某个模型,仍取决于接入平台提供的能力。

先检查计划,再发出请求

工具要求 Node.js 22+,没有第三方运行时依赖,支持 Windows、macOS 和 Linux。按 仓库说明 安装后,可以先在 Skill 目录查看帮助和配置状态:

node asset-gen.mjs --help
node asset-gen.mjs doctor
node asset-gen.mjs image "pixel art fantasy character" "outputs/character.png" --dry-run

--dry-run 只校验并展示执行计划,不联网生成。doctor 用于检查配置,不代表账户有余额,也不证明当前通道支持指定模型。

让长任务可以继续

视频任务通常包含提交、轮询和下载几个阶段。使用 --submit-only 时,工具会先保存任务状态;之后用 resume 继续查询与下载,而不是重新提交一次生成。

node asset-gen.mjs resume "outputs/clip.mp4.task.json" --json

生成 POST 不自动重试。网络结果不明时,直接再发一次可能造成重复任务和额外费用;保留任务状态,才有机会分清该等待、恢复,还是重新开始。

交付前检查输出

工具会检查输出类型,拒绝 HTML 错误页、伪装成图片的响应,以及与扩展名不匹配的媒体。下载请求不携带生成 API 的密钥,已有文件也不会被直接覆盖。

这些检查能挡住一部分错误,但不能替代素材验收。文件容器标记正确,不代表角色一致、画面完整或声音合适;最终仍需要检查尺寸、时长、画面与声音。

降级路径也需要显式选择。本地生成的 BGM 与远端音乐模型输出不是同一回事,不应混在一起宣称为相同成果。

当前边界

公开测试主要使用本地模拟服务验证协议与实现行为,不代表所有付费通道都已实测。当前也不支持蒙版编辑、自动格式转换、覆盖写入或并发写同一路径。

源文件已在 GitHub 公开,仓库目前未指定开放源码许可证。使用与再分发前,应先查看仓库的最新说明。