Paraformer实时语音识别-8k-v2

复制成功!
立即体验加入对比
实时语音识别

概述

实时语音识别

推荐使用 Paraformer最新实时语音识别模型,支持多个语种自由切换的视频直播、会议等实时场景的语音识别。可以通过language_hints参数选择语种获得更准确的识别效果。支持8kHz电话客服等场景下的实时语音识别。 支持的语言包括:中文(含粤语等各种方言)、英文、日语、韩语。

输入

音频

输出

文本

功能

前缀补全

函数调用

缓存

结构化输出

批量任务

联网搜索

微调

定价

  • 音频时长
    ¥0.00024每秒

速率限制

    API 参考

    获取 API Key
    复制成功!
    123456789101112131415161718192021222324252627
    from http import HTTPStatus
    from dashscope.audio.asr import Recognition
    
    # 若没有将API Key配置到环境变量中,需将下面这行代码注释放开,并将apiKey替换为自己的API Key
    # import dashscope
    # dashscope.api_key = "apiKey"
    
    recognition = Recognition(model='paraformer-realtime-8k-v2',
                              format='wav',
                              sample_rate=16000,
                              # “language_hints”只支持paraformer-realtime-v2模型
                              language_hints=['zh', 'en'],
                              callback=None)
    result = recognition.call('asr_example.wav')
    if result.status_code == HTTPStatus.OK:
        print('识别结果:')
        print(result.get_sentence())
    else:
        print('Error: ', result.message)
        
    print(
        '[Metric] requestId: {}, first package delay ms: {}, last package delay ms: {}'
        .format(
            recognition.get_last_request_id(),
            recognition.get_first_package_delay(),
            recognition.get_last_package_delay(),
        ))