Hyperbolic (Hyperbolic)
综合排名 #15 ⭐ 可考虑
❌ 需代理 | 🌍 国际
💰 Token 价格
| 类型 | 价格 | 备注 |
|---|---|---|
| 输入 (Input) | Per-token inference scaled from market GPU rates; H100 from $2.89/GPU-hour, H200 $3.49/GPU-hour | 每百万 tokens |
| 输出 (Output) | Pay-as-you-go GPU compute billed per hour; reserved discounts for committed capacity | 每百万 tokens |
💡 免费额度
无长期合同;按量计费按小时结算;无永久免费档,但无配额上限、即开即用
🤖 支持模型(共 30 个)
DeepSeek R1 DeepSeek R1-0528 Llama 3.3 70B Qwen 2.5 72B NVIDIA Nemotron Mixtral 8x22B
✨ 优势
- ✓ 开源权重模型 OpenAI 兼容推理 API
- ✓ H100/H200/B200 按需 GPU,分钟级拉起,无配额上限
- ✓ H200 每 GPU 小时 $3.49,低于 RunPod/AWS/Azure 等主流
- ✓ Forge 基础设施层,虚拟化开销仅约 2%
- ✓ Dedicated Model Hosting 单租户托管,支持 HIPAA/SOC2/GDPR
⚠️ 不足
- × 中国大陆无直连端点,需代理或聚合商
- × 推理按 token 定价未完全公开,主要看市场 GPU 时价
- × GPU 市场价格随供需实时波动
- × 文档以 JS 渲染为主,技术向,非中文
- × 无第一方旗舰闭源模型,专注开源权重生态
🎯 适合场景
需要按需 GPU 训练/微调 + OpenAI 兼容推理 API 的团队;追求最低 H100/H200 时价的开发者;能接受代理访问的国际用户
💰 价格与方案
| GPU / 方案 | 价格 | 计费方式 | 备注 |
|---|---|---|---|
| H100 SXM | 约 $2.89 / GPU 小时 | 按小时、按需 | 市场价;最便宜的 Hopper 主流选项 |
| H200 SXM | $3.49 / GPU 小时 | 按小时、按需 | 141GB HBM3e;低于 RunPod $4.39、AWS 约 $5.97+、Azure 约 $13.78 |
| B200 | 随行就市 | 按小时、按需 | Blackwell,适合更大模型与 FP4 推理 |
| Reserved 预留 | 折扣预付费 | 承诺期 <1 年 | 专用容量,可用性可预期 |
| Private Cloud 私有云 | 定制报价 | 长期 | 供应商网络专属基础设施,规模成本最低 |
| 推理 API | 按 token 计费 | 按用量 | OpenAI 兼容,随实时 GPU 市场价浮动 |
🔧 API 与开发者体验
- •API 接口: Hyperbolic 提供 OpenAI 兼容的推理 API,标准 OpenAI SDK 只需替换 base_url 即可使用。同一账号还可按需拉起 GPU 实例,通过 SSH 进行训练、微调、批量计算与智能体自动化。
- •GPU 市场: 几分钟内从控制台拉起 H100、H200 或 B200 容量,无配额上限。按量小时计费、无长期锁定,并基于实时供需给出动态价格。
- •Forge: Hyperbolic 的基础设施层(2026-06-10 上线)跨分布式 GPU 供应商管理完整的机器生命周期——配置、安全加固、镜像管理、监控与运行后清理——虚拟化开销约 2%。
- •推理栈: 模型托管运行在 Hyperbolic 自研推理引擎、vLLM 或 SGLang 之上。Dedicated Model Hosting 在单租户预留 GPU 上提供私有的客户专属 API 端点。
- •合规: Dedicated 与 Private Cloud 层通过单租户计算、隔离网络与无提示词日志,支持 HIPAA、SOC2 与 GDPR 要求,并提供 SLA 保障的可用性目标。
🖥️ GPU 市场与 Forge
Hyperbolic 的核心差异化在于按需 GPU 市场。2026 年 7 月其 H200 定价为每 GPU 小时 $3.49(141GB HBM3e、4.8TB/s 带宽)——低于它对比的所有主流厂商:RunPod $4.39、AWS Capacity Blocks 约 $5.97-6.87、Oracle $10、Azure 约 $13.78。市场背后是 Forge 基础设施层,它将数十个分布式 GPU 供应商的配置、安全加固与清理标准化,虚拟化开销比裸金属仅高约 2%。新用户无需配额申请即可即刻获得容量,并可从单张按需 GPU 平滑扩展到 Reserved 集群或 Private Cloud。
🌐 区域可用性与延迟
Hyperbolic 是总部位于美国的开放 AI 云,GPU 容量来自全球计算供应商网络,因此延迟取决于你选择的供应商与区域。中国大陆无区域端点,也无官方中国访问计划,国内生产使用需要稳定的海外代理或前置 Hyperbolic API 的聚合商。团队可在离用户或训练数据更近的区域按需扩容,OpenAI 兼容的推理接口也让集成延迟保持在较低水平。分布式供应商模型以单一区域的一致性为代价,换来北美、欧洲与亚太更广的弹性容量。