DeepSeek(深度求索) (DeepSeek)

收录于 https://platform.deepseek.com

综合排名 #4 ⭐⭐ 推荐
✅ 国内直连 | 🇨🇳 国内可用

💰 Token 价格

类型 价格 备注
输入 (Input) DeepSeek-V3: ¥0.14/M token (≈$0.02), R1: ¥0.14/M 每百万 tokens
输出 (Output) DeepSeek-V3: ¥0.28/M token (≈$0.04), R1: ¥0.28/M 每百万 tokens
💡 免费额度

注册送 ¥500 免费额度(约500万tokens)

🤖 支持模型(共 3 个)

DeepSeek-V3 DeepSeek-R1 DeepSeek-Coder-V2

✨ 优势

  • 行业最低价:DeepSeek-V3 ¥0.14/M input
  • R1 推理模型:媲美 o1 的推理能力,¥0.14/M 的价格
  • 国内直接访问,无需代理
  • 注册即送 ¥500,超长试用期
  • 开源模型系列,社区活跃度高
  • 中文优化,本地需求场景表现出色

⚠️ 不足

  • × 模型数量少(仅 3 个)
  • × API 偶尔不稳定(国内大流量时)
  • × 英文能力稍逊于 GPT-4o/Claude
  • × 无多模态输出
  • × 不支持 Function Calling(R1 不支持,V3 有限支持)

🎯 适合场景

国内开发者;成本敏感型应用;推理类任务(R1);中英文混合场景

💰 价格与方案

模型输入 (¥/百万 token)输出 (¥/百万 token)最佳用途
DeepSeek-V3¥0.14 (≈$0.02)¥0.28 (≈$0.04)通用对话、中英混合任务
DeepSeek-R1¥0.14 (≈$0.02)¥0.28 (≈$0.04)链式推理
DeepSeek-Coder-V2¥0.14 (≈$0.02)¥0.28 (≈$0.04)代码生成、代码审查
缓存命中 (V3/R1)¥0.014 (≈$0.002)重复系统提示,9 折
夜间折扣0.5× 输入/输出0.5× 输入/输出北京时间每日 00:30–08:30

🔧 API 与开发者体验

  • API 风格: OpenAI 兼容的 /v1/chat/completions 端点 — 替换 base_url 即可作为任何 OpenAI SDK 的即插即用替代。
  • Base URL: https://api.deepseek.com/v1 — 中国大陆直连,无需代理。
  • SDK 兼容性: 通过替换 base_url 和 api_key 即可与 OpenAI 官方 Python/Node SDK 配合使用;社区 SDK 覆盖 Go、Java、Rust。
  • 函数调用 / 工具: DeepSeek-V3(稳定)和 R1 通过专用 deepseek-reasoner 端点支持(带 tool_choice);输出经 JSON schema 验证。
  • 流式输出: 默认提供 SSE token 流式;R1 还会流式输出推理链(CoT),再给出最终答案。
  • 上下文窗口: V3 和 R1 均支持 128K token — 足以容纳中等长度文档、长代码库或长多轮对话。
  • Prompt 缓存: 官方缓存命中价 ¥0.014/M(常规输入的 1/10)— 相同系统前缀的重复请求成本大幅下降。

🧠 R1 推理模型仅 ¥0.14/M

DeepSeek-R1 的标志性特征是 o1 同级的链式推理能力,价格仅为后者的零头。OpenAI 的 o1/o3 高级推理定价 $10–$60/百万 token,R1 仅 ¥0.14 输入 / ¥0.28 输出 — 约相当于 OpenAI 同级定价的 1/40。模型通过流式接口完整暴露推理过程,开发者可在最终答案前检查 CoT 步骤用于调试或审计。 R1 在数学(AIME、MATH-500)、代码推理(LiveCodeBench)和研究生级 QA 基准上表现强劲,这些场景中逐步逻辑比流畅度更重要。V3 是更便宜的通用型,R1 是推理专精型 — 两者定价相同,选择取决于工作负载。在中文推理任务上 R1 同样是顶级选手,常常在中文数学奥赛题上追平或击败西方推理模型。

🌐 中国访问与延迟

DeepSeek 是少数几家在中国大陆提供一线模型官方直连的提供商之一。api.deepseek.com 端点通过国内 BGP 路由服务中国大陆流量 — 北京/上海典型延迟在 80–250ms 首 token 流式响应,生成速度 5–15 tokens/sec,无需 VPN 或代理。国际访问(从美/欧访问 api.deepseek.com)也通过同一端点支持,延迟略高。 对生产负载而言,DeepSeek 是面向中国服务应用的天然默认选择,特别是在数据驻留(无跨境传输)和成本可预测性很重要的场景。相对 OpenAI/Anthropic 的权衡点是英文流利度、多模态能力与生态工具链 — DeepSeek-V3 仅支持文本,工具调用覆盖面也窄于 GPT-4o。构建中国优先 AI 产品的开发者通常将 DeepSeek 与国际模型搭配使用,而非二选一。