Vanchin DeepSeek
复制成功!
文本生成
概述
文本生成
DeepSeek-V3 由深度求索(DeepSeek)于 2024 年 12 月发布,是目前开源社区领先的混合专家(MoE)语言模型:总参数 671B,每个 token 仅激活 37B 参数。模型在 14.8 万亿高质量 tokens 上完成预训练,原生支持 128k 上下文。通过创新的无辅助损失负载均衡策略、多头潜在注意力(MLA)架构和 FP8 混合精度训练。
输入
文本
输出
文本
功能
定价
- 输入¥2/M tokens
- 输出¥8/M tokens
- 输入(缓存命中)¥0.8/M tokens
速率限制与上下文
- 最大输入131.07K
- 最大输出16.38K
- RPM每分钟请求数500
- TPM每分钟 Token 数1M
- 上下文131.07K
API 参考
开通模型开通后即可体验并通过 API 调用该模型。复制成功!
1234567891011121314151617181920212223
from openai import OpenAI
import os
client = OpenAI(
api_key="sk-xxx", # 替换为你的百炼API Key
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1",
)
completion = client.chat.completions.create(
model="vanchin/deepseek-v3",
messages=[{"role": "user", "content": "你是谁"}],
extra_body={"enable_thinking": True},
stream=True,
)
for chunk in completion:
if not chunk.choices:
continue
delta = chunk.choices[0].delta
if hasattr(delta, "reasoning_content") and delta.reasoning_content:
print(delta.reasoning_content, end="", flush=True)
if hasattr(delta, "content") and delta.content:
print(delta.content, end="", flush=True)