Qwen-Audio-ASR-Flash-Streaming
复制成功!
概述
qwen-audio-3.0-asr-flash-streaming是通义实验室专为低延迟、高并发实时交互场景打造的旗舰级语音识别模型。它不仅能实现“边说边出字”的极致流畅体验,并深度集成了 Context(上下文增强)能力,还针对垂直行业专业词汇进行了深度强化训练,是构建实时会议同传、智能客服坐席辅助、语音助手等应用的首选。
输入
音频
输出
文本
功能
定价
- 音频时长¥0.00033每秒
速率限制
- RPM每分钟请求数1K
API 参考
调用API复制成功!
123456789101112131415161718192021222324252627
from http import HTTPStatus
import dashscope
from dashscope.audio.asr import Recognition
import os
dashscope.api_key = os.environ.get('DASHSCOPE_API_KEY')
dashscope.base_websocket_api_url='wss://dashscope.aliyuncs.com/api-ws/v1/inference'
recognition = Recognition(model='qwen-audio-3.0-asr-flash-streaming',
format='wav',
sample_rate=16000,
callback=None)
result = recognition.call('{YOUR_AUDIO_FILE}')
if result.status_code == HTTPStatus.OK:
print('Recognition result: ')
print(result.get_sentence())
else:
print('Error: ', result.message)
print(
'[Metric] requestId: {}, first package delay ms: {}, last package delay ms: {}'
.format(
recognition.get_last_request_id(),
recognition.get_first_package_delay(),
recognition.get_last_package_delay(),
))