Paraformer语音识别-v1

复制成功!
立即体验加入对比
语音识别

概述

语音识别

Paraformer中英文语音识别模型,支持16kHz及以上采样率的音频或视频语音识别。

输入

音频

输出

文本

功能

前缀补全

您可在调用通义千问 API 时启用 Partial Mode,确保模型严格基于您的起始文本进行生成。查看文档

函数调用

您可以使用 函数调用 功能,通过引入外部工具,使得大模型可以与外部世界进行交互。查看文档

缓存

Context Cache 技术会缓存长上下文请求的公共前缀,减少推理时的重复计算,提升响应速度同时降低您的使用成本。查看文档

结构化输出

开启结构化输出功能可以确保大模型输出标准格式的 JSON 字符串。查看文档

批量任务

联网搜索

启用联网检索功能后,模型将基于实时检索数据进行回复。查看文档

微调

定价

  • 音频时长
    ¥0.00008每秒

速率限制

    API 参考

    获取 API Key
    复制成功!
    12345678910111213141516171819
    from http import HTTPStatus
    from dashscope.audio.asr import Transcription
    import json
    
    # 若没有将API Key配置到环境变量中,需将下面这行代码注释放开,并将apiKey替换为自己的API Key
    # import dashscope
    # dashscope.api_key = "apiKey"
    
    task_response = Transcription.async_call(
        model='paraformer-v1',
        file_urls=['https://dashscope.oss-cn-beijing.aliyuncs.com/samples/audio/paraformer/hello_world_female2.wav',
                   'https://dashscope.oss-cn-beijing.aliyuncs.com/samples/audio/paraformer/hello_world_male2.wav']
        # language_hints=['zh', 'en']  # “language_hints”只支持paraformer-v2模型
    )
    
    transcribe_response = Transcription.wait(task=task_response.output.task_id)
    if transcribe_response.status_code == HTTPStatus.OK:
        print(json.dumps(transcribe_response.output, indent=4, ensure_ascii=False))
        print('transcription done!')