模型参考视频模型
视频模型
浏览 @dlazy/cli 提供的视频模型。
happyhorse-1.0— Happy Horse 1.0 视频模型,一站式覆盖文生视频(t2v)、首帧生视频(i2v)、参考图生视频(r2v)与视频编辑(edit):根据所选模式自动路由到对应子模型。heygen-lipsync-speed— HeyGen Lipsync Speed:快速唇形同步模型,适合对生成速度要求较高的场景jimeng-dream-actor— 即梦人物/动作驱动视频模型,支持参考图与参考视频输入,适合人物演绎、动作迁移与风格一致性生成。jimeng-i2v-first— 即梦首帧生视频模型,使用首帧图+文本生成视频。适合让静态图片自然动起来的单镜头场景。jimeng-i2v-first-tail— 即梦首尾帧视频模型,支持首帧与尾帧约束以控制镜头起止状态,适合转场与动作收束明确的片段。jimeng-omnihuman-1.5— 即梦同源数字人模型,支持任意画幅包含人物/主体的图片结合音频生成高质量数字人视频。kling-v3— Kling V3 通用视频模型,支持文本+最多 4 张参考图,适合稳定产出短视频片段与日常创作流程。kling-v3-omni— Kling Omni 视频模型,支持多参考图、时长、模式(std/pro)与可选音频。适合高控制度的视频合成任务。pixverse-c1— 爱诗 PixVerse C1 视频生成模型(擅长打斗、法术特效、高速运动等高动态场景),一站式覆盖文生视频、图生视频、首尾帧生视频与参考图生视频:未提供图时走文生视频,仅首帧时走图生视频,首+尾帧时走首尾帧生视频,提供参考图时走参考图生视频。seedance-2.0— 字节最新视频生成模型,支持多模态参考生视频(图片+视频+音频)、首尾帧及文生视频,适合高质量多样化视频创作。seedance-2.0-fast— 字节最新视频生成模型 Fast 版,生成速度更快,支持多模态参考生视频、首尾帧及文生视频。sync-lipsync-3— fal.ai sync-lipsync v3 唇形对齐模型,输入一段视频和一段音频,输出说话人嘴型与音频对齐的新视频。适合配音、外语本地化、虚拟人重新对口型。veo-3.1— 高质量视频生成模型,支持文本生视频与单图驱动视频。适合广告短片、镜头感强的成片生成(速度较慢、质量更高)。veo-3.1-fast— 快速版视频生成模型,支持文本生视频与单图/多图/首尾帧驱动。适合时间敏感的预览与快速迭代场景。video-audio-split— 音视频分离工具:使用 ffmpeg 将视频拆分为无声视频与纯音频两个文件,便于分别编辑或再处理。video-replicate— 视频复刻工具:从源视频中提取首帧与音频,并调用视频理解生成描述提示,输出 Seedance 2.0 复刻方案(首帧 + 音频 + 视频)三件套。videoretalk— 通义声动人像 VideoRetalk 口型同步(对口型、lip sync / lip-sync、配音对嘴)视频模型,输入一段人物讲话视频与一段人声音频,生成讲话口型与音频匹配的新视频;适用于让人物视频的口型对上新的语音。当视频中存在多张人脸时,可额外提供人脸参考图来指定要替换口型的目标人物。videoseg— 视频人像分割工具:调用阿里云 SegmentVideoBody 异步任务,返回与原视频同时长的 mask 视频(黑白蒙版),可用于后续合成或抠像处理。viduq2-i2v— Vidu 图生视频模型,支持参考图驱动视频、时长/分辨率/比例与音频参数配置,适合图片动效化与短片生成。wan2.7— 通义万相 2.7 视频生成模型,一站式覆盖文生视频、首尾帧生视频与参考图生视频:未提供图时走文生视频,提供首/尾帧时走首尾帧生视频,提供参考图时走参考图生视频。