Vanchin DeepSeek

复制成功!
开通模型开通后即可体验并通过 API 调用该模型。加入对比
视觉理解文本生成

概述

视觉理解文本生成

DeepSeek-OCR以 “探索视觉 - 文本压缩边界” 为核心目标,从大语言模型(LLM)视角重新定义视觉编码器的功能定位,为文档识别、图像转文本等高频场景提供了兼顾精度与效率的全新解决方案。

输入

文本图像

输出

文本

功能

前缀补全

函数调用

缓存

结构化输出

批量任务

联网搜索

微调

定价

  • 输入
    ¥0.216/M tokens
  • 输出
    ¥0.216/M tokens

上下文

上下文
8.19K
最大输入
8.19K
最大输出
8.19K

速率限制

  • RPM每分钟请求数
    500
  • TPM每分钟 Token 数
    1M

API 参考

开通模型开通后即可体验并通过 API 调用该模型。
复制成功!
12345678910111213141516171819202122232425262728293031
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    base_url="https://dashscope.aliyuncs.com/compatible-mode/v1",
)

completion = client.chat.completions.create(
    model="vanchin/deepseek-ocr",
    messages=[
        {
            "role": "user",
            "content": [
                {
                    "type": "image_url",
                    "image_url": {
                        "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20241108/ctdzex/biaozhun.jpg",
                        "detail": "high",
                    },
                },
                {
                    "type": "text",
                    "text": "Read all the text in the image.",
                },
            ],
        }
    ],
)

print(completion.choices[0].message.content)