dLazy AIdLazy AI
模型参考文本工具

elevenlabs-stt

ElevenLabs scribe_v1 语音转文字,支持自动语种识别与说话人分离,适合字幕、转录与会议记录。

ElevenLabs scribe_v1 语音转文字,支持自动语种识别与说话人分离,适合字幕、转录与会议记录。

概览

字段
Model IDelevenlabs-stt
CLIdlazy elevenlabs-stt
MCPelevenlabs-stt(在 Claude Code 中显示为 mcp__dlazy__elevenlabs-stt
类型text
执行异步任务,默认轮询直到完成(--no-wait 可立即返回 generateId
批量支持 --batch <n> 并行扇出

参数

参数类型必填说明
audio_urlurlYes音频链接;audio(接受 URL、本地路径或 data: URL)
language_code"zh" | "en"No语言;默认 "zh"
diarizestringNo区分说话人;默认 false

--input @file.json--input '{...}' 也可一次性提供所有参数;命令行 flag 优先级更高。

CLI 示例

dlazy elevenlabs-stt --help
dlazy elevenlabs-stt --audio_url "https://example.com/source.mp3"
dlazy elevenlabs-stt --audio_url "./local-audio.mp3"
dlazy elevenlabs-stt --audio_url "https://example.com/source.mp3" --dry-run
dlazy elevenlabs-stt --audio_url "https://example.com/source.mp3" --no-wait
dlazy elevenlabs-stt --audio_url "https://example.com/source.mp3" --batch 4

与管道组合

dlazy gemini-2.5-tts --prompt "参考音频" \
  | dlazy elevenlabs-stt --audio_url -

MCP

MCP 由 AI 客户端调用,无需手写示例。把 dLazy 注册成 MCP server 后,工具会自动出现在客户端的工具列表里——Claude Code 中名字是 mcp__dlazy__elevenlabs-stt,OpenClaw 等通用客户端按裸 elevenlabs-stt 调用。

添加 MCP server 见 MCP 集成

输出

{
  "outputs": [
    { "type": "json", "id": "o_...", "value": { /* tool-specific payload */ } }
  ]
}

结构化结果以 json output 返回,具体字段取决于该工具。

On this page