基础地址 · 模型 qwen3-asr-1.7b · 支持 30 种语言 + 22 种方言
# 1. 非流式转写(OpenAI 兼容) curl -X POST /v1/audio/transcriptions \ -F file=@test.wav -F model=qwen3-asr-1.7b # => {"text":"识别结果","duration_ms":2000,"model":"qwen3-asr-1.7b"} # 2. SSE 流式转写(分段增量推送) curl -N -X POST /v1/audio/transcriptions \ -F file=@test.wav -F model=qwen3-asr-1.7b -F stream=true # data: {"object":"transcription.chunk","text":"你好","start_ms":0,"end_ms":1800} # data: {"object":"transcription.done","text":"你好 世界","segments":2,"wall_ms":890} # data: [DONE] # 3. WebSocket 实时会话(浏览器麦克风) ws = new WebSocket("/v1/realtime") ws.binaryType = "arraybuffer" ws.send(JSON.stringify({type:"session.update", language:"Chinese"})) ws.send(arrayBufferPCM16Mono16k) // 二进制音频帧 // {"type":"transcript.partial","text":"..."} 增量结果 // {"type":"transcript.final","text":"..."} 整句结果