Qwen3-LiveTranslate-Flash
复制成功!
实时语音识别
概述
实时语音识别
Qwen3-LiveTranslate-Flash,一款高精度、高响应、高鲁棒性的多语言实时音视频同传大模型。依托Qwen3-Omni强大的基座能力、海量多模态数据、跨语言跨模态对齐和视觉增强等技术,Qwen3-LiveTranslate-Flash 实现了离线和实时两种音视频翻译能力,能听懂19种语言,会说10种语言以及8种中文方言。
输入
音频视频
输出
文本音频
功能
定价
- 输入:音频¥10/M tokens
- 输入:图片¥4/M tokens
- 输出:文本¥10/M tokens
- 输出:音频¥40/M tokens
速率限制与上下文
- 最大输入49.15K
- 最大输出4.09K
- RPM每分钟请求数100
- TPM每分钟 Token 数100K
- 上下文53.24K