Qwen-TTS

复制成功!
加入对比
语音合成

概述

语音合成

模型是动态更新版本,等同于最新版本快照模型,模型更新时不会提前通知。

输入

文本

输出

音频

功能

前缀补全

您可在调用通义千问 API 时启用 Partial Mode,确保模型严格基于您的起始文本进行生成。查看文档

函数调用

您可以使用 函数调用 功能,通过引入外部工具,使得大模型可以与外部世界进行交互。查看文档

缓存

Context Cache 技术会缓存长上下文请求的公共前缀,减少推理时的重复计算,提升响应速度同时降低您的使用成本。查看文档

结构化输出

开启结构化输出功能可以确保大模型输出标准格式的 JSON 字符串。查看文档

批量任务

联网搜索

启用联网检索功能后,模型将基于实时检索数据进行回复。查看文档

微调

定价

  • 输入:文本
    ¥1.6/M tokens
  • 输出:音频
    ¥10/M tokens

速率限制与上下文

  • 最大输入
    512
  • 最大输出
    7.68K
  • RPM每分钟请求数
    10
  • TPM每分钟 Token 数
    100K
  • 上下文
    8.19K

API 参考

获取 API Key
复制成功!
1234567891011121314
# DashScope SDK 版本不低于 1.23.1
import os
import dashscope

text = "那我来给大家推荐一款T恤,这款呢真的是超级好看,这个颜色呢很显气质,而且呢也是搭配的绝佳单品,大家可以闭眼入,真的是非常好看,对身材的包容性也很好,不管啥身材的宝宝呢,穿上去都是很好看的。推荐宝宝们下单哦。"
response = dashscope.audio.qwen_tts.SpeechSynthesizer.call(
    # 仅支持qwen-tts系列模型,请勿使用除此之外的其他模型
    model="qwen-tts-latest",
    # 若没有配置环境变量,请用阿里云百炼API Key将下行替换为:api_key="sk-xxx"
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    text=text,
    voice="Cherry",
)
print(response)