AI 工作流
game-creator:把图片、视频与声音接进 Agent 工作流
从素材生成到任务恢复,介绍 game-creator 2.0 如何组织多媒体调用、文件校验与交付。
素材生成之后,工作还没结束
游戏原型和创意项目常常同时需要角色图、短视频、旁白与 BGM。接入生成接口只是第一步:请求有没有提交成功、文件能不能打开、任务中断后能不能继续,同样影响实际使用。
game-creator 把这些环节放进一套 Skill 和命令行工具。目前的 2.0 版本覆盖文生图、图生图、图片理解、文生视频、图生视频、语音与 BGM,便于 Agent 在同一工作流中调用。
一个入口,多种媒体协议
图片编辑、视频生成与语音接口并不共用一套请求格式。工具用适配器区分这些协议,例如图片编辑可选择网关 JSON 或标准 multipart edits,视频任务也需要匹配对应的适配器。
模型由用户配置,也可以用 --model 临时覆盖。工具不会把未知的视频模型一律当作某一种协议处理。能否使用某个模型,仍取决于接入平台提供的能力。
先检查计划,再发出请求
工具要求 Node.js 22+,没有第三方运行时依赖,支持 Windows、macOS 和 Linux。按 仓库说明 安装后,可以先在 Skill 目录查看帮助和配置状态:
node asset-gen.mjs --help
node asset-gen.mjs doctor
node asset-gen.mjs image "pixel art fantasy character" "outputs/character.png" --dry-run
--dry-run 只校验并展示执行计划,不联网生成。doctor 用于检查配置,不代表账户有余额,也不证明当前通道支持指定模型。
让长任务可以继续
视频任务通常包含提交、轮询和下载几个阶段。使用 --submit-only 时,工具会先保存任务状态;之后用 resume 继续查询与下载,而不是重新提交一次生成。
node asset-gen.mjs resume "outputs/clip.mp4.task.json" --json
生成 POST 不自动重试。网络结果不明时,直接再发一次可能造成重复任务和额外费用;保留任务状态,才有机会分清该等待、恢复,还是重新开始。
交付前检查输出
工具会检查输出类型,拒绝 HTML 错误页、伪装成图片的响应,以及与扩展名不匹配的媒体。下载请求不携带生成 API 的密钥,已有文件也不会被直接覆盖。
这些检查能挡住一部分错误,但不能替代素材验收。文件容器标记正确,不代表角色一致、画面完整或声音合适;最终仍需要检查尺寸、时长、画面与声音。
降级路径也需要显式选择。本地生成的 BGM 与远端音乐模型输出不是同一回事,不应混在一起宣称为相同成果。
当前边界
公开测试主要使用本地模拟服务验证协议与实现行为,不代表所有付费通道都已实测。当前也不支持蒙版编辑、自动格式转换、覆盖写入或并发写同一路径。
源文件已在 GitHub 公开,仓库目前未指定开放源码许可证。使用与再分发前,应先查看仓库的最新说明。