模型参考文本工具
elevenlabs-stt
ElevenLabs scribe_v1 语音转文字,支持自动语种识别与说话人分离,适合字幕、转录与会议记录。
ElevenLabs scribe_v1 语音转文字,支持自动语种识别与说话人分离,适合字幕、转录与会议记录。
概览
| 字段 | 值 |
|---|---|
| Model ID | elevenlabs-stt |
| CLI | dlazy elevenlabs-stt |
| MCP | elevenlabs-stt(在 Claude Code 中显示为 mcp__dlazy__elevenlabs-stt) |
| 类型 | text |
| 执行 | 异步任务,默认轮询直到完成(--no-wait 可立即返回 generateId) |
| 批量 | 支持 --batch <n> 并行扇出 |
参数
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
audio_url | url | Yes | 音频链接;audio(接受 URL、本地路径或 data: URL) |
language_code | "zh" | "en" | No | 语言;默认 "zh" |
diarize | string | No | 区分说话人;默认 false |
--input @file.json与--input '{...}'也可一次性提供所有参数;命令行 flag 优先级更高。
CLI 示例
dlazy elevenlabs-stt --help
dlazy elevenlabs-stt --audio_url "https://example.com/source.mp3"
dlazy elevenlabs-stt --audio_url "./local-audio.mp3"
dlazy elevenlabs-stt --audio_url "https://example.com/source.mp3" --dry-run
dlazy elevenlabs-stt --audio_url "https://example.com/source.mp3" --no-wait
dlazy elevenlabs-stt --audio_url "https://example.com/source.mp3" --batch 4与管道组合
dlazy gemini-2.5-tts --prompt "参考音频" \
| dlazy elevenlabs-stt --audio_url -MCP
MCP 由 AI 客户端调用,无需手写示例。把 dLazy 注册成 MCP server 后,工具会自动出现在客户端的工具列表里——Claude Code 中名字是 mcp__dlazy__elevenlabs-stt,OpenClaw 等通用客户端按裸 elevenlabs-stt 调用。
添加 MCP server 见 MCP 集成。
输出
{
"outputs": [
{ "type": "json", "id": "o_...", "value": { /* tool-specific payload */ } }
]
}结构化结果以 json output 返回,具体字段取决于该工具。