Paraformer语音识别-8k-v2
复制成功!
语音识别
概述
语音识别
Paraformer最新中文语音识别模型,模型结构升级,具有更好的识别效果,支持8kHz电话语音识别,仅支持中文热词。
输入
音频
输出
文本
功能
定价
- 音频时长¥0.00008每秒
速率限制
API 参考
获取 API Key复制成功!
12345678910111213141516171819
from http import HTTPStatus
from dashscope.audio.asr import Transcription
import json
# 若没有将API Key配置到环境变量中,需将下面这行代码注释放开,并将apiKey替换为自己的API Key
# import dashscope
# dashscope.api_key = "apiKey"
task_response = Transcription.async_call(
model='paraformer-8k-v2',
file_urls=['https://dashscope.oss-cn-beijing.aliyuncs.com/samples/audio/paraformer/hello_world_female2.wav',
'https://dashscope.oss-cn-beijing.aliyuncs.com/samples/audio/paraformer/hello_world_male2.wav']
# language_hints=['zh', 'en'] # “language_hints”只支持paraformer-v2模型
)
transcribe_response = Transcription.wait(task=task_response.output.task_id)
if transcribe_response.status_code == HTTPStatus.OK:
print(json.dumps(transcribe_response.output, indent=4, ensure_ascii=False))
print('transcription done!')