DeepSeek
复制成功!
立即体验加入对比
概述
高效轻量化MoE模型,总参284B,激活13B,原生支持百万超长上下文能力。推理速度快、延迟低、调用成本低廉,综合能力均衡,主打高并发、轻量化任务,适合日常对话、内容创作、基础 RAG、批量文案处理等普惠刚需场景。
输入
文本
输出
文本
功能
定价
- 输入¥1.5/M tokens
- 输入¥3/M tokens
- 输出¥4.5/M tokens
- 输出¥9/M tokens
- 输入(缓存命中)¥0.15/M tokens
- 输入(缓存命中)¥0.3/M tokens
速率限制与上下文
- 最大输入1M
- 最大输出393K
- 上下文1M
- TPM每分钟 Token 数1M
- RPM每分钟请求数15K
API 参考
调用API复制成功!
123456789101112131415161718192021222324252627282930
from openai import OpenAI
import os
client = OpenAI(
# 如果没有配置环境变量,请用阿里云百炼API Key替换:api_key="sk-xxx"
api_key=os.getenv("DASHSCOPE_API_KEY"),
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1",
)
messages = [{"role": "user", "content": "你是谁"}]
completion = client.chat.completions.create(
model="deepseek-v4-flash-0731", # 您可以按需更换为其它深度思考模型
messages=messages,
extra_body={"enable_thinking": True},
stream=True
)
is_answering = False # 是否进入回复阶段
print("\n" + "=" * 20 + "思考过程" + "=" * 20)
for chunk in completion:
if not chunk.choices:
continue
delta = chunk.choices[0].delta
if hasattr(delta, "reasoning_content") and delta.reasoning_content is not None:
if not is_answering:
print(delta.reasoning_content, end="", flush=True)
if hasattr(delta, "content") and delta.content:
if not is_answering:
print("\n" + "=" * 20 + "完整回复" + "=" * 20)
is_answering = True
print(delta.content, end="", flush=True)