模型 API 谁都能调。难的是把一句灵感变成一条能发的片子:长任务怎么轮询、镜头间人物怎么一致、 哪一镜不合格该重跑哪一镜、跑一次到底花多少钱。这些工程问题我们已经在生产环境里解完了。
每个环节都是独立接口,能只要分镜、也能一句剧本直接进整链编排
一句创意扩写成分集剧本,含人物设定与对白节奏。
按目标题材重写,保留结构、优化冲突与台词。
长文本自动拆分,切分点落在叙事节拍上。
拆到镜头粒度:景别、机位、时长、画面描述。
14 种预设画风,同一分镜可出多版对比选型。
Seedance 2.0 音画同生,逐镜生成与重试。
TTS 配音、字幕对齐、剪辑拼接导出成片。
全链异步:提交任务 → 轮询或回调取结果 → 单镜失败只重跑该镜。 中间产物(剧本、分集、分镜、单镜视频、音轨)全部落库可查,不用整链重来。
避免联调到第三天才发现格式不对
| 环节 | 输入 | 输出 | 说明 |
|---|---|---|---|
| 剧本 / 分集 | 纯文本、一句创意 | 结构化分集剧本(JSON) | 含人物、场景、对白字段 |
| AI 分镜 | 单集剧本文本 | 镜头数组 | 景别 / 机位 / 时长 / 画面描述 / 台词 |
| 画风渲染 | 分镜描述 + 画风 ID | 图片 URL | 14 种预设画风,可指定参考图保持人物一致 |
| 视频生成 | 分镜 + 画风图 | 视频片段 URL | 9:16 竖屏为主,1080p,音画同生 |
| 配音与字幕 | 台词文本 / 视频 | 音轨 + SRT 字幕 | 多音色,支持多语种翻译与配音 |
| 成片合成 | 片段数组 + 编排参数 | 成片 URL | 按分镜顺序拼接,可加分镜转场与 BGM |
| 任务状态 | task_id | 状态 + 进度 + 产物 | 轮询或回调两种方式都支持 |
| 成本查询 | task_id / 时间区间 | 逐环节用量与金额 | 每次调用花了多少,能拆开给你看 |
以上为我方生产环境实际形态。具体字段与限流参数在联调前以书面接口文档交付,不做到一半再改。
差别主要在你的数据能不能出内网、以及谁承担并发
直接调我方服务,按调用量结算。适合快速验证与量级不确定的阶段,不占用你的运维。
整套流水线部署在你自己的云或内网,模型 Key 与数据库都在你侧。适合数据敏感与量级已稳定的场景。
交付流水线源码与文档,你在上面自己长。适合要把这套能力做成核心竞争力长期投入的团队。
这两块是 demo 与能上线的产品之间真正的差距,也是我们主要卖的东西
一次生成不理想就重跑,重跑就是真金白银。所以每一镜都要能算账。
模型输出天然不稳。不解决这一层,交付物就是一堆不能用的素材。
长任务全异步,任务表 + 状态机 + 回调,不占用请求线程;排队与超时策略写在接口文档里。
文本与图像审核回调已接入,接第三方业务时这一层必须有,我们会默认带上而不是等你问。
任务级日志与用量统计,能回答“昨天那 200 条片子花多少钱、失败多少、失败在哪一镜”。
不丢一份文档就结束。从字段对齐到灰度上线,我方参与联调,把问题在上线前解决。
可以。七个环节各自是独立接口,常见用法是只要“剧本 → 分镜 JSON”,画面与合成自己做。也可以反过来,只调用逐镜生视频那一步。
瓶颈在模型侧配额,不在我们的编排层。所以这个数我不会先给你一个吹牛值:先说你的峰值目标,我按你需要的并发反推需要哪些模型配额、多少钱、要不要备用路由,写在方案里。
私有化与源码授权两种方式下,模型 Key 完全在你侧,我方不接触。API 方式下用的是我方配额,按调用量结算 —— 两种模式的成本谁承担,会在报价里写清。
取决于分镜数与单镜时长,并且天然是异步的。我们按“任务提交 → 完成”给你实测区间,联调阶段会给出 P50 与 P95,而不是给一个最好情况的数字。
验收标准在方案阶段就写死:画风一致性与人物一致性抽样合格率、单条重跑率、成本上限。达不到就不进入下一阶段 —— 比口头承诺“我们会调好”可靠。
同一条流水线由我们代跑:交付 9:16 竖屏成片与分镜脚本,支持多集连载与批量供稿。