Hyperbolic (Hyperbolic)

收录于 https://hyperbolic.xyz

综合排名 #15 ⭐ 可考虑
❌ 需代理 | 🌍 国际

💰 Token 价格

类型 价格 备注
输入 (Input) Per-token inference scaled from market GPU rates; H100 from $2.89/GPU-hour, H200 $3.49/GPU-hour 每百万 tokens
输出 (Output) Pay-as-you-go GPU compute billed per hour; reserved discounts for committed capacity 每百万 tokens
💡 免费额度

无长期合同;按量计费按小时结算;无永久免费档,但无配额上限、即开即用

🤖 支持模型(共 30 个)

DeepSeek R1 DeepSeek R1-0528 Llama 3.3 70B Qwen 2.5 72B NVIDIA Nemotron Mixtral 8x22B

✨ 优势

  • 开源权重模型 OpenAI 兼容推理 API
  • H100/H200/B200 按需 GPU,分钟级拉起,无配额上限
  • H200 每 GPU 小时 $3.49,低于 RunPod/AWS/Azure 等主流
  • Forge 基础设施层,虚拟化开销仅约 2%
  • Dedicated Model Hosting 单租户托管,支持 HIPAA/SOC2/GDPR

⚠️ 不足

  • × 中国大陆无直连端点,需代理或聚合商
  • × 推理按 token 定价未完全公开,主要看市场 GPU 时价
  • × GPU 市场价格随供需实时波动
  • × 文档以 JS 渲染为主,技术向,非中文
  • × 无第一方旗舰闭源模型,专注开源权重生态

🎯 适合场景

需要按需 GPU 训练/微调 + OpenAI 兼容推理 API 的团队;追求最低 H100/H200 时价的开发者;能接受代理访问的国际用户

💰 价格与方案

GPU / 方案价格计费方式备注
H100 SXM约 $2.89 / GPU 小时按小时、按需市场价;最便宜的 Hopper 主流选项
H200 SXM$3.49 / GPU 小时按小时、按需141GB HBM3e;低于 RunPod $4.39、AWS 约 $5.97+、Azure 约 $13.78
B200随行就市按小时、按需Blackwell,适合更大模型与 FP4 推理
Reserved 预留折扣预付费承诺期 <1 年专用容量,可用性可预期
Private Cloud 私有云定制报价长期供应商网络专属基础设施,规模成本最低
推理 API按 token 计费按用量OpenAI 兼容,随实时 GPU 市场价浮动

🔧 API 与开发者体验

  • API 接口: Hyperbolic 提供 OpenAI 兼容的推理 API,标准 OpenAI SDK 只需替换 base_url 即可使用。同一账号还可按需拉起 GPU 实例,通过 SSH 进行训练、微调、批量计算与智能体自动化。
  • GPU 市场: 几分钟内从控制台拉起 H100、H200 或 B200 容量,无配额上限。按量小时计费、无长期锁定,并基于实时供需给出动态价格。
  • Forge: Hyperbolic 的基础设施层(2026-06-10 上线)跨分布式 GPU 供应商管理完整的机器生命周期——配置、安全加固、镜像管理、监控与运行后清理——虚拟化开销约 2%。
  • 推理栈: 模型托管运行在 Hyperbolic 自研推理引擎、vLLM 或 SGLang 之上。Dedicated Model Hosting 在单租户预留 GPU 上提供私有的客户专属 API 端点。
  • 合规: Dedicated 与 Private Cloud 层通过单租户计算、隔离网络与无提示词日志,支持 HIPAA、SOC2 与 GDPR 要求,并提供 SLA 保障的可用性目标。

🖥️ GPU 市场与 Forge

Hyperbolic 的核心差异化在于按需 GPU 市场。2026 年 7 月其 H200 定价为每 GPU 小时 $3.49(141GB HBM3e、4.8TB/s 带宽)——低于它对比的所有主流厂商:RunPod $4.39、AWS Capacity Blocks 约 $5.97-6.87、Oracle $10、Azure 约 $13.78。市场背后是 Forge 基础设施层,它将数十个分布式 GPU 供应商的配置、安全加固与清理标准化,虚拟化开销比裸金属仅高约 2%。新用户无需配额申请即可即刻获得容量,并可从单张按需 GPU 平滑扩展到 Reserved 集群或 Private Cloud。

🌐 区域可用性与延迟

Hyperbolic 是总部位于美国的开放 AI 云,GPU 容量来自全球计算供应商网络,因此延迟取决于你选择的供应商与区域。中国大陆无区域端点,也无官方中国访问计划,国内生产使用需要稳定的海外代理或前置 Hyperbolic API 的聚合商。团队可在离用户或训练数据更近的区域按需扩容,OpenAI 兼容的推理接口也让集成延迟保持在较低水平。分布式供应商模型以单一区域的一致性为代价,换来北美、欧洲与亚太更广的弹性容量。