Qwen-VL-Embedding

复制成功!
加入对比
向量

概述

向量

基于Qwen2.5-VL底座训练的统一多模态向量模型,支持文本、图片、视频单模态/混合模态输入,输出统一表征向量,适用于跨模态检索、图搜、视频检索、图像聚类、复杂多模态信息检索、打标等场景

输入

文本图像

输出

功能

前缀补全

函数调用

缓存

结构化输出

批量任务

联网搜索

微调

定价

  • 图片输入
    ¥1.8/M tokens
  • 文本输入
    ¥0.7/M tokens

速率限制

  • RPM每分钟请求数
    1.20K
  • TPM每分钟 Token 数
    600K

API 参考

获取 API Key
复制成功!
1234567891011
import dashscope

text = "通用多模态表征模型示例"
input = [{'text': text}]
resp = dashscope.MultiModalEmbedding.call(
    model="qwen2.5-vl-embedding",
    input=input
)

print(resp)