DigitalOcean Gradient (DigitalOcean Gradient)

收录于 https://gradient.digitalocean.com

综合排名 #17 ⭐ 可考虑
❌ 需代理 | 🌍 国际

💰 Token 价格

类型 价格 备注
输入 (Input) Llama 3.3 70B: $0.50/M, DeepSeek-R1: $0.80/M 每百万 tokens
输出 (Output) Llama 3.3 70B: $0.50/M, DeepSeek-R1: $0.80/M 每百万 tokens
💡 免费额度

新用户 $100 免费额度(60 天有效)

🤖 支持模型(共 15 个)

Llama 3.3 70B Llama 3.1 405B DeepSeek-R1 Qwen 2.5 72B Mixtral 8x22B Mistral Large 2 Gemma 2 27B Phi-3 Medium

✨ 优势

  • DigitalOcean 品牌可靠,开发者信任度高
  • 新用户 $100 免费额度
  • OpenAI 兼容 API
  • 定价透明且有竞争力
  • NVIDIA H100 GPU 基础设施
  • 2026 年 5 月加入 OpenRouter Provider 名录

⚠️ 不足

  • × 国内需代理访问
  • × 模型数量有限(15个开源模型)
  • × 不支持多模态输入
  • × 新入 OpenRouter,口碑待积累
  • × 无自研模型,依赖社区开源

🎯 适合场景

DigitalOcean 现有客户;需要 $100 免费额度试验的开发者;开源模型部署

💰 价格与方案

模型输入 ($/百万)输出 ($/百万)备注
Llama 3.3 70B$0.50$0.50均衡旗舰模型,Gradient 与 OpenRouter(digitalocean/llama-3.3-70b-instruct)均可路由
Llama 3.1 405B$0.90$0.90Gradient 上最大的开源通用模型
DeepSeek-R1$0.80$0.80推理模型,也可经 OpenRouter 路由
Qwen 2.5 72B经 Gradient 无服务器端,按 token 计费
DeepSeek V4 Flash 07312026-08-06 加入 DeepSeek 家族阵容
DeepSeek V4 Pro 08132026-08-14 加入,Agent 能力 + 100 万上下文

🔧 API 与开发者体验

  • API 接口: Gradient 提供 OpenAI 兼容的聊天补全端点(https://inference.do-ai.run/v1/)。标准 OpenAI SDK 只需替换 base_url 与 api_key。在 OpenRouter 上,模型以 digitalocean/ 前缀访问(如 digitalocean/llama-3.3-70b-instruct),无需单独 DigitalOcean 账号。
  • 注册与额度: 在 cloud.digitalocean.com 注册并添加支付方式,新用户可获得 $200 额度(60 天有效)。无需销售沟通,完全自助。
  • 无服务器 vs GPU Droplet: Gradient AI 平台为托管模型处理自动扩缩、批处理与路由(按 token 计费);GPU Droplet 则按小时提供裸 H100/H200/L40S/A100 实例,可自行部署 vLLM/TGI/SGLang 或定制栈。
  • 函数调用与 Agent: 聊天补全端点支持函数调用/工具使用。Agent 平台额外提供托管工具绑定(网页搜索、计算器、代码执行)以及托管的 Knowledge Base 向量库,可对 PDF/文档进行分块与嵌入。
  • API Key 管理: 在 DO 控制台生成按作用域划分的 API Token;同一 Token 可用于 GPU Droplet、无服务器推理、Spaces 及 DigitalOcean 生态其他产品。

🤖 开源权重目录与 OpenRouter 接入

DigitalOcean Gradient 是两款产品拼接而成:GPU Droplet(按小时计费的 H100/H200/L40S/A100 虚拟服务器)与 Gradient AI 平台(2025 年底重新上线的无服务器推理与 Agent 层)。平台托管精选开源权重目录(Llama 3.3 70B、Llama 3.1 405B、DeepSeek-R1、Qwen 2.5 72B、Mixtral、Mistral Large 2、Gemma 2、Phi-3),不含任何自研闭源模型——每个模型都是社区开源权重。2026 年 6 月 3 日接入 OpenRouter 后,所有 OpenRouter 用户都能通过 digitalocean/ 模型前缀访问这些模型而无需 DigitalOcean 账号,实际上把 DigitalOcean 变成了更广泛 API 生态的匿名开源推理后端。2026 年 8 月目录扩展到 DeepSeek V4 家族:V4 Flash 0731(8-06)与 V4 Pro 0813(8-14)加入无服务器推理,带来 100 万上下文与更强的 Agent 工具调用。Knowledge Base 与 Agent 功能构建在无服务器层之上,让繁琐的 RAG 流水线(向量存储、分块、嵌入、工具绑定)与你的 droplet 在同一控制台内完成。

🌐 区域可用性与延迟

DigitalOcean Gradient 推理运行在 DigitalOcean 覆盖北美与欧洲数据中心的全球网络上,无服务器请求会落在离你的 droplet 与应用服务器最近的位置。OpenAI 兼容端点把客户端集成延迟保持在较低水平。中国大陆没有区域端点,也没有官方中国访问计划:控制台可能被墙,API 调用需要通过稳定的海外代理或聚合商转发。OpenRouter 的中国直连边缘是实用替代方案——通过 OpenRouter 路由到 digitalocean/llama-3.3-70b-instruct,让大陆开发者以更优链路访问同一批模型。对于直接控制延迟的团队,GPU Droplet 可固定到所选区域,使 vLLM/TGI 服务与其余栈共置,为生产负载提供可预测的 p95 延迟。