Qwen3-LiveTranslate-Flash
复制成功!
实时语音识别
概述
实时语音识别
Qwen3-LiveTranslate-Flash,一款高精度、高响应、高鲁棒性的多语言实时音视频同传大模型。依托Qwen3-Omni强大的基座能力、海量多模态数据、跨语言跨模态对齐和视觉增强等技术,Qwen3-LiveTranslate-Flash 实现了离线和实时两种音视频翻译能力,能听懂19种语言,会说10种语言以及8种中文方言。此版本为2025年12月01日的快照版本。
输入
音频视频
输出
文本音频
功能
前缀补全
函数调用
缓存
结构化输出
批量任务
联网搜索
微调
定价
- 输入:音频¥10/M tokens
- 输入:图片¥4/M tokens
- 输出:文本¥10/M tokens
- 输出:音频¥40/M tokens
上下文
上下文
53.24K
最大输入
49.15K
最大输出
4.09K
速率限制
- RPM每分钟请求数100
- TPM每分钟 Token 数100K