Paraformer语音识别-v2

复制成功!
立即体验加入对比
语音识别

概述

语音识别

推荐使用 Paraformer最新语音识别模型,支持多个语种的语音识别。可以通过language_hints参数选择语种获得更准确的识别效果,支持任意采样率。 支持的语言包括:中文(含粤语等各种方言)、英文、日语、韩语。可支持热词。

输入

音频

输出

文本

功能

前缀补全

函数调用

缓存

结构化输出

批量任务

联网搜索

微调

定价

  • 音频时长
    ¥0.00008每秒

速率限制

    API 参考

    获取 API Key
    复制成功!
    12345678910111213141516171819
    from http import HTTPStatus
    from dashscope.audio.asr import Transcription
    import json
    
    # 若没有将API Key配置到环境变量中,需将下面这行代码注释放开,并将apiKey替换为自己的API Key
    # import dashscope
    # dashscope.api_key = "apiKey"
    
    task_response = Transcription.async_call(
        model='paraformer-v2',
        file_urls=['https://dashscope.oss-cn-beijing.aliyuncs.com/samples/audio/paraformer/hello_world_female2.wav',
                   'https://dashscope.oss-cn-beijing.aliyuncs.com/samples/audio/paraformer/hello_world_male2.wav']
        # language_hints=['zh', 'en']  # “language_hints”只支持paraformer-v2模型
    )
    
    transcribe_response = Transcription.wait(task=task_response.output.task_id)
    if transcribe_response.status_code == HTTPStatus.OK:
        print(json.dumps(transcribe_response.output, indent=4, ensure_ascii=False))
        print('transcription done!')