01
POST/v1/audio-separations人声分离
把一个视频分离为人声音轨与背景声音轨。
成功结果人声 WAV + 背景声 WAV
LYNSEY DUBBING / OPEN API
通过统一的 REST 接口调用人声分离、字幕识别、字幕翻译、AI 配音与自动译制。创建异步业务资源,使用查询或 Webhook 获取最终成果。
/v1/auto-localizations{
"source": {
"type": "url",
"url": "https://media.example.com/episode-01.mp4"
},
"source_language": "zh-CN",
"target_language": "en-US",
"mode": "full",
"voice_mode": "auto",
"subtitle_output": "burned",
"original_audio": "preserve",
"resolution": "original"
}{ "id": "loc_…", "status": "queued" }任务已受理,通过资源 ID 查询进度或等待 Webhook。
01 / BUSINESS CAPABILITIES
POST/v1/audio-separations把一个视频分离为人声音轨与背景声音轨。
POST/v1/subtitle-recognitions从视频人声识别字幕,可区分说话人。
POST/v1/subtitle-translations翻译已有 SRT 或结构化字幕行。
POST/v1/dubbings根据目标语言字幕生成时间轴对齐的配音。
POST/v1/auto-localizations在服务端完成识别、翻译、配音与视频合成。
02 / ASYNCHRONOUS BY DESIGN
传入可直接读取的公网 HTTPS 地址,或使用预签名上传。
使用 API Key 与 HMAC-SHA256 签名,创建对应业务资源。
根据资源 ID 查询 queued、processing 与最终状态。
通过 GET 或终态 Webhook 获取结果,并在有效期内转存。
申请上传地址 → 直传对象存储 → 提交 ETag 并等待素材校验。只有 ready 状态的 upload_id 才能创建业务资源。
prepare → upload → complete → ready03 / ACCESS & CONTROL
每组密钥只允许调用创建时勾选的业务能力。
可为单组密钥设置月度 Credit 上限,用于控制集成方消耗。
可限制请求来源的公网出口 IP;未配置时不启用来源限制。
API Secret 与 Webhook Secret 仅创建时显示,并分别用于请求和回调验签。
04 / BILLING & RETENTION
| 能力 | 实际用量口径 |
|---|---|
| 人声分离 | 源视频时长,按开始的分钟向上取整 |
| 字幕识别 | 源视频时长,按开始的分钟向上取整 |
| 字幕翻译 | 成功生成的字幕条数 |
| AI 配音 | 目标语言字符数,按开始的 1000 字符向上取整 |
| 自动译制 | 源视频时长,按开始的分钟向上取整 |