模型参考视频模型
videoretalk
通义声动人像 VideoRetalk 口型同步(对口型、lip sync / lip-sync、配音对嘴)视频模型,输入一段人物讲话视频与一段人声音频,生成讲话口型与音频匹配的新视频;适用于让人物视频的口型对上新的语音。当视频中存在多张人脸时,可额外提供人脸参考图来指定要替换口型的目标人物。
通义声动人像 VideoRetalk 口型同步(对口型、lip sync / lip-sync、配音对嘴)视频模型,输入一段人物讲话视频与一段人声音频,生成讲话口型与音频匹配的新视频;适用于让人物视频的口型对上新的语音。当视频中存在多张人脸时,可额外提供人脸参考图来指定要替换口型的目标人物。
概览
| 字段 | 值 |
|---|---|
| Model ID | bailian-videoretalk |
| CLI | dlazy videoretalk |
| MCP | videoretalk(在 Claude Code 中显示为 mcp__dlazy__videoretalk) |
| 类型 | video |
| 执行 | 异步任务,默认轮询直到完成(--no-wait 可立即返回 generateId) |
| 批量 | 支持 --batch <n> 并行扇出 |
参数
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
video_url | url | Yes | 视频链接;video(接受 URL、本地路径或 data: URL) |
audio_url | url | Yes | 音频链接;audio(接受 URL、本地路径或 data: URL) |
ref_image_url | url | No | 人脸参考图;image(接受 URL、本地路径或 data: URL) |
video_extension | "true" | "false" | No | 按音频时长扩展视频;默认 "false" |
query_face_threshold | string | No | 人脸匹配置信度;默认 170;仅当 ref_image_url is non-empty |
--input @file.json与--input '{...}'也可一次性提供所有参数;命令行 flag 优先级更高。
CLI 示例
dlazy videoretalk --help
dlazy videoretalk --video_url "https://example.com/source.mp4" --audio_url "https://example.com/source.mp3"
dlazy videoretalk --video_url "./local-video.mp4" --audio_url "https://example.com/source.mp3"
dlazy videoretalk --video_url "https://example.com/source.mp4" --audio_url "https://example.com/source.mp3" --dry-run
dlazy videoretalk --video_url "https://example.com/source.mp4" --audio_url "https://example.com/source.mp3" --no-wait
dlazy videoretalk --video_url "https://example.com/source.mp4" --audio_url "https://example.com/source.mp3" --batch 4与管道组合
dlazy seedance-2.0-fast --prompt "参考视频" \
| dlazy videoretalk --video_url -MCP
MCP 由 AI 客户端调用,无需手写示例。把 dLazy 注册成 MCP server 后,工具会自动出现在客户端的工具列表里——Claude Code 中名字是 mcp__dlazy__videoretalk,OpenClaw 等通用客户端按裸 videoretalk 调用。
添加 MCP server 见 MCP 集成。
输出
{
"outputs": [
{ "type": "video", "id": "o_...", "url": "https://files.dlazy.com/result.mp4", "mimeType": "video/mp4" }
]
}媒体类型工具返回 image / video / audio / file output;可通过 --output url 让 stdout 只保留 URL。