DeepSeek - DeepSeek网页版 · 探索未至之境 · 深度求索 - DeepSeek api开放平台

本平台提供完整的开发接口说明、费率标准体系及开源评测框架。《DeepSeek API开发者调用指南与费率》助力商业团队以极具优势的计算成本快速部署大模型服务;《DeepSeek Harness基准自动化评测框架》赋能学术与工程团队建立标准化评定基线。

GUIDE // 01

API 极速接入规范

DeepSeek API 完全兼容 OpenAI 官方接口协议。开发者无需学习新的通信契约,只需在已有 SDK 或网络请求客户端中将 base_url 配置为官方分发网关,并传入您的高权限 api_key 即可发起调用。

# 核心请求端点与模型标识
API_BASE_URL = "https://api.deepseek.com/v1"
MODEL_REASONING = "deepseek-reasoner"  # DeepSeek-R1 满血版
MODEL_CHAT      = "deepseek-chat"      # DeepSeek-V3 对话版
DeepSeek API 密钥签发与控制台界面
FIG.01 // API KEY MANAGEMENT CONSOLE
API 请求链路与分布式并发负载监控图
FIG.02 // DISTRIBUTED REQUEST MONITORING
PRICING // 02

模型调用费率对照与长尾优惠

遵循普惠 AI 原则,平台实行按实际消耗 Token 计费模式,杜绝最低消费门槛。输入命中缓存时可享受大幅度成本削减,帮助企业大幅压低大规模生产环境的智能化运营开支。

模型名称 上下文长度 输入价格 (Cache Miss) 输入价格 (Cache Hit) 输出价格 (含思维链)
DeepSeek-R1 (满血版) 128K ¥0.004 / 千Token ¥0.001 / 千Token ¥0.016 / 千Token
DeepSeek-V3 (标准版) 128K ¥0.002 / 千Token ¥0.0005 / 千Token ¥0.008 / 千Token
DeepSeek-R1-Distill 系列 32K / 64K ¥0.001 / 千Token ¥0.0002 / 千Token ¥0.002 / 千Token
FRAMEWORK // 03

DeepSeek Harness 基准自动化评测框架

DeepSeek Harness基准自动化评测框架 是一套面向强化学习推理大模型量身定制的标准化评测脚手架。它原生支持 GSM8K、MATH、HumanEval、MBPP 以及长文本“大海捞针”等前沿评测集,通过多进程并行调度与确定性评估流水线,消除随机偏差,输出高置信度的客观评估报告。

# 启动 DeepSeek Harness 自动化数学评测
python -m deepseek_harness \
    --model_name "deepseek-reasoner" \
    --benchmarks "math_500,aime2024,humaneval" \
    --num_fewshot 0 \
    --batch_size 16 \
    --output_filepath "./eval_reports/r1_benchmark.json"
DeepSeek Harness 自动化评测结果图表与收敛曲线
FIG.03 // HARNESS BENCHMARK CONVERGENCE REPORT
大模型长文本大海捞针测试与多任务对比大盘
FIG.04 // 128K NEEDLE-IN-A-HAYSTACK VISUALIZATION
DEVELOPMENT // 04

Python 接入与流式思维链解析代码范例

通过标准 OpenAI Python SDK,即可轻松捕获 DeepSeek-R1 模型的实时思维链字段 reasoning_content 与最终结论输出 content。

from openai import OpenAI

client = OpenAI(
    api_key="your_deepseek_api_key_here",
    base_url="https://api.deepseek.com"
)

response = client.chat.completions.create(
    model="deepseek-reasoner",
    messages=[
        {"role": "user", "content": "9.11 和 9.8 哪个数字更大?请给出严密数理比对推导。"}
    ],
    stream=True
)

for chunk in response:
    delta = chunk.choices[0].delta
    if hasattr(delta, "reasoning_content") and delta.reasoning_content:
        # 实时打印思维链逻辑
        print(delta.reasoning_content, end="", flush=True)
    elif delta.content:
        # 打印最终确定答案
        print(delta.content, end="", flush=True)
TROUBLESHOOTING // 05

常见状态码排查与合规防护

若在调用过程中收到非 200 HTTP 状态码,请参照下述列表快速定位原因:

  • 401 Unauthorized:API Key 签名错误或已失效,请在控制台重新核验密钥;
  • 402 Insufficient Balance:账户可用代币配额已用罄,请前往计费充值中心操作;
  • 429 Rate Limit Exceeded:单分钟请求频率(RPM)或并发 Token 数(TPM)触顶,请加入指数退避重试(Exponential Backoff);
  • 503 Service Unavailable:机房瞬时算力调度峰值,系统将自动平移至华东或华南备用节点集群。