🎙️
OddASR2 Demo
流式语音识别测试
🌊 流式识别
📂 文件流式
📁 离线识别
WebSocket 状态:
未连接
ws://localhost:9003/v1/realtime
🌊 流式识别 (Streaming ASR。
查看API文档
)
选择模型
切换模型
语言
热词(多个用空格分隔)
开始录音
清空结果
等待开始
复制
复制
使用WebSocket实时传输麦克风音频流进行识别
📂 文件流式识别 (File Streaming ASR)
主要用于:用历史音频模拟复现流式转写测试,以对比同一音频在不同引擎下的实时转写效果。
选择音频文件
发送参数
Chunk 时长:
300ms
600ms
1000ms
语言:
热词:
模拟实时发送
开始流式识别
清空结果
等待选择文件
复制
复制
📁 离线识别 (Offline ASR)
选择模型
切换模型
语言
热词(多个用空格分隔)
选择音频文件 (WAV/MP3)
返回格式(
点击查看说明文档
)
Text (纯文本)
说话人分离参数(可选,留空使用配置默认值,
说明文档
)
指定说话人数量 (preset_spk_num)
最大说话人数 (max_num_spks)
合并阈值 (merge_thr, 0-1)
分离粒度 (spk_mode)
使用配置默认
punc_segment (按标点句)
vad_segment (按VAD段)
default
上传并识别
识别中,大文件可能需要数分钟,请耐心等待...
复制
⚙️ 模型选项配置
查看后端当前支持的所有模型选项
刷新
展开