SERVICE 03 · 给有系统的团队

已经有人在用的那条流水线,可以直接接进你的产品

模型 API 谁都能调。难的是把一句灵感变成一条能发的片子:长任务怎么轮询、镜头间人物怎么一致、 哪一镜不合格该重跑哪一镜、跑一次到底花多少钱。这些工程问题我们已经在生产环境里解完了。

🎞️ Pipeline

七个环节,可单调也可整链

每个环节都是独立接口,能只要分镜、也能一句剧本直接进整链编排

STAGE 01

剧本生成

一句创意扩写成分集剧本,含人物设定与对白节奏。

STAGE 02

剧本润色

按目标题材重写,保留结构、优化冲突与台词。

STAGE 03

智能分集

长文本自动拆分,切分点落在叙事节拍上。

STAGE 04

AI 分镜

拆到镜头粒度:景别、机位、时长、画面描述。

STAGE 05

画风渲染

14 种预设画风,同一分镜可出多版对比选型。

STAGE 06

视频生成

Seedance 2.0 音画同生,逐镜生成与重试。

STAGE 07

配音合成

TTS 配音、字幕对齐、剪辑拼接导出成片。

全链异步:提交任务 → 轮询或回调取结果 → 单镜失败只重跑该镜。 中间产物(剧本、分集、分镜、单镜视频、音轨)全部落库可查,不用整链重来。

📐 规格

输入输出先说清楚

避免联调到第三天才发现格式不对

环节输入输出说明
剧本 / 分集纯文本、一句创意结构化分集剧本(JSON)含人物、场景、对白字段
AI 分镜单集剧本文本镜头数组景别 / 机位 / 时长 / 画面描述 / 台词
画风渲染分镜描述 + 画风 ID图片 URL14 种预设画风,可指定参考图保持人物一致
视频生成分镜 + 画风图视频片段 URL9:16 竖屏为主,1080p,音画同生
配音与字幕台词文本 / 视频音轨 + SRT 字幕多音色,支持多语种翻译与配音
成片合成片段数组 + 编排参数成片 URL按分镜顺序拼接,可加分镜转场与 BGM
任务状态task_id状态 + 进度 + 产物轮询或回调两种方式都支持
成本查询task_id / 时间区间逐环节用量与金额每次调用花了多少,能拆开给你看

以上为我方生产环境实际形态。具体字段与限流参数在联调前以书面接口文档交付,不做到一半再改。

🔌 集成方式

三种接法,按你的数据与运维边界选

差别主要在你的数据能不能出内网、以及谁承担并发

最快 · 1 周起

API 调用

直接调我方服务,按调用量结算。适合快速验证与量级不确定的阶段,不占用你的运维。

数据边界
经我方服务
并发承担
我方
计费
按量 / 包月
常用 · 2–3 周

私有化部署

整套流水线部署在你自己的云或内网,模型 Key 与数据库都在你侧。适合数据敏感与量级已稳定的场景。

数据边界
全在你侧
并发承担
你方,我方调优
计费
部署费 + 维保
最深 · 按范围定

源码授权

交付流水线源码与文档,你在上面自己长。适合要把这套能力做成核心竞争力长期投入的团队。

数据边界
全在你侧
并发承担
你方
计费
一次性授权
📊 工程细节

AI 视频最难的两件事:成本与稳定性

这两块是 demo 与能上线的产品之间真正的差距,也是我们主要卖的东西

成本治理

一次生成不理想就重跑,重跑就是真金白银。所以每一镜都要能算账。

  • 逐环节、逐镜头记账,单条片子的成本能拆开看
  • 按量定价可配置,不同模型与分辨率分档计价
  • 多模型路由与降级:主模型限流时自动切备用
  • 失败只重跑该镜,不整链重来,避免重复消耗

质量治理

模型输出天然不稳。不解决这一层,交付物就是一堆不能用的素材。

  • 分镜与成片质量评分,不达阈值不进入下一环节
  • 自动重写与重试策略,把人工返工降到可控范围
  • 角色与场景资产复用,保证跨镜人物一致性
  • 中间产物全部落库可查,问题能定位到具体镜头

异步与并发

长任务全异步,任务表 + 状态机 + 回调,不占用请求线程;排队与超时策略写在接口文档里。

内容安全

文本与图像审核回调已接入,接第三方业务时这一层必须有,我们会默认带上而不是等你问。

可观测

任务级日志与用量统计,能回答“昨天那 200 条片子花多少钱、失败多少、失败在哪一镜”。

联调陪跑

不丢一份文档就结束。从字段对齐到灰度上线,我方参与联调,把问题在上线前解决。

❓ 常见问题

技术评估时会问到的事

只要分镜,不要成片,可以吗?

可以。七个环节各自是独立接口,常见用法是只要“剧本 → 分镜 JSON”,画面与合成自己做。也可以反过来,只调用逐镜生视频那一步。

并发能力有多少?

瓶颈在模型侧配额,不在我们的编排层。所以这个数我不会先给你一个吹牛值:先说你的峰值目标,我按你需要的并发反推需要哪些模型配额、多少钱、要不要备用路由,写在方案里。

能不能换我们自己的模型 Key?

私有化与源码授权两种方式下,模型 Key 完全在你侧,我方不接触。API 方式下用的是我方配额,按调用量结算 —— 两种模式的成本谁承担,会在报价里写清。

生成一条片子要多久?

取决于分镜数与单镜时长,并且天然是异步的。我们按“任务提交 → 完成”给你实测区间,联调阶段会给出 P50 与 P95,而不是给一个最好情况的数字。

效果不满意怎么验收?

验收标准在方案阶段就写死:画风一致性与人物一致性抽样合格率、单条重跑率、成本上限。达不到就不进入下一阶段 —— 比口头承诺“我们会调好”可靠。

要接口文档和接入方案,留个联系方式

说明你的系统形态与峰值目标,我们把字段、限流、成本三项算清楚再谈价格。