Paraformer语音识别-mtl-v1
复制成功!
立即体验加入对比
语音识别
概述
语音识别
Paraformer多语言语音识别模型,支持16kHz及以上采样率的音频或视频语音识别。 支持的语种/方言包括:中文普通话、中文方言(粤语、吴语、闽南语、东北话、甘肃话、贵州话、河南话、湖北话、湖南话、宁夏话、山西话、陕西话、山东话、四川话、天津话)、英语、日语、韩语、西班牙语、印尼语、法语、德语、意大利语、马来语。
输入
音频
输出
文本
功能
定价
- 音频时长¥0.00008每秒
速率限制
API 参考
获取 API Key复制成功!
12345678910111213141516171819
from http import HTTPStatus
from dashscope.audio.asr import Transcription
import json
# 若没有将API Key配置到环境变量中,需将下面这行代码注释放开,并将apiKey替换为自己的API Key
# import dashscope
# dashscope.api_key = "apiKey"
task_response = Transcription.async_call(
model='paraformer-mtl-v1',
file_urls=['https://dashscope.oss-cn-beijing.aliyuncs.com/samples/audio/paraformer/hello_world_female2.wav',
'https://dashscope.oss-cn-beijing.aliyuncs.com/samples/audio/paraformer/hello_world_male2.wav']
# language_hints=['zh', 'en'] # “language_hints”只支持paraformer-v2模型
)
transcribe_response = Transcription.wait(task=task_response.output.task_id)
if transcribe_response.status_code == HTTPStatus.OK:
print(json.dumps(transcribe_response.output, indent=4, ensure_ascii=False))
print('transcription done!')