Qwen-Audio-ASR-Flash-Filetrans

复制成功!
加入对比

概述

qwen-audio-3.0-asr-flash-filetrans是专为非实时、整段音视频文件设计的高性能转写模型。它不仅集成了 Context(上下文增强)能力,还强化了垂直行业热词的识别精度,非常适合短视频字幕、客服质检和金融双录场景。

输入

音频

输出

文本

功能

前缀补全

调用通义千问 API 时启用 Partial Mode,可让模型严格接续您提供的前缀文本进行生成。查看文档

函数调用

通过函数调用将大模型与外部工具和系统连接起来。查看文档

缓存

Context Cache 会缓存长上下文请求的公共前缀,减少重复计算、提升响应速度并降低成本。查看文档

结构化输出

结构化输出可确保模型返回符合预期格式的 JSON 字符串。查看文档

批量任务

异步批量处理请求,降低调用成本。查看文档

联网搜索

启用联网搜索后,模型可基于实时检索的数据进行回答。查看文档

微调

基于样本数据训练模型,使其更适配特定任务。查看文档

定价

  • 音频时长
    ¥0.00022每秒

速率限制

  • RPM每分钟请求数
    600

API 参考

调用API
复制成功!
123456789101112131415
curl --location 'https://dashscope.aliyuncs.com/api/v1/services/audio/asr/transcription' \
     --header "Authorization: Bearer $DASHSCOPE_API_KEY" \
     --header "Content-Type: application/json" \
     --header "X-DashScope-Async: enable" \
     --data '{
    "model": "qwen-audio-3.0-asr-flash-filetrans",
    "input": {
        "file_urls": [
            "{YOUR_AUDIO_URL}"
        ]
    },
    "parameters": {
        "channel_id": [0]
    }
}'