Qwen3-LiveTranslate-Flash

复制成功!
加入对比
实时语音识别

概述

实时语音识别

Qwen3-LiveTranslate-Flash,一款高精度、高响应、高鲁棒性的多语言实时音视频同传大模型。依托Qwen3-Omni强大的基座能力、海量多模态数据、跨语言跨模态对齐和视觉增强等技术,Qwen3-LiveTranslate-Flash 实现了离线和实时两种音视频翻译能力,能听懂19种语言,会说10种语言以及8种中文方言。

输入

音频视频

输出

文本音频

功能

前缀补全

函数调用

缓存

结构化输出

批量任务

联网搜索

微调

定价

  • 输入:音频
    ¥10/M tokens
  • 输入:图片
    ¥4/M tokens
  • 输出:文本
    ¥10/M tokens
  • 输出:音频
    ¥40/M tokens

上下文

上下文
53.24K
最大输入
49.15K
最大输出
4.09K

速率限制

  • RPM每分钟请求数
    100
  • TPM每分钟 Token 数
    100K