Fun-ASR实时语音识别
复制成功!
实时语音识别
概述
实时语音识别
通义百聆推出的新一代轻量级实时语音识别模型,依托自研的先进语音技术架构,具备强大的上下文理解能力。专为中文电话客服场景设计:覆盖多地区方言口音,在低采样率、低信噪比环境下实现低延迟、高准确率的流式转写,满足高效部署需求。
输入
音频
输出
文本
功能
前缀补全
函数调用
缓存
结构化输出
批量任务
联网搜索
微调
定价
- 音频时长¥0.00022每秒
速率限制
- RPM每分钟请求数1.20K
API 参考
获取 API Key复制成功!
123456789101112131415161718192021222324252627
from http import HTTPStatus
from dashscope.audio.asr import Recognition
# 若没有将API Key配置到环境变量中,需将下面这行代码注释放开,并将apiKey替换为自己的API Key
# import dashscope
# dashscope.api_key = "apiKey"
recognition = Recognition(model='fun-asr-flash-8k-realtime',
format='wav',
sample_rate=16000,
# “language_hints”只支持paraformer-realtime-v2模型
language_hints=['zh', 'en'],
callback=None)
result = recognition.call('asr_example.wav')
if result.status_code == HTTPStatus.OK:
print('识别结果:')
print(result.get_sentence())
else:
print('Error: ', result.message)
print(
'[Metric] requestId: {}, first package delay ms: {}, last package delay ms: {}'
.format(
recognition.get_last_request_id(),
recognition.get_first_package_delay(),
recognition.get_last_package_delay(),
))