FriendliAI 2026 评测:前沿推理 API 与专属 GPU 端点
FriendliAI 是一家韩国总部的前沿推理云平台,提供两类核心服务:按 Token 计费的 Model API(适用于前沿开源模型)和按秒计费的专属 GPU 端点(已获 SOC 2 Type II 和 HIPAA 合规认证)。其定价页面无需登录即可查看所有模型价格,模型目录涵盖 Hugging Face 上 59 万+ 开源模型。
与 Fireworks AI 或 Together AI 等美国竞争对手相比,FriendliAI 的独特优势在于亚太基础设施(首尔机房)和一套清晰的定价模型 — 从单次 API 调用到多 GPU B300 集群,按实际用量付费。
核心要点
- Model API:输入从 $0.14/百万起(Gemma-4-31B),输出最高 $4.4/百万(GLM-5.2)— 按 Token 计费,无最低消费
- 专属端点:从 $2.9/时(A100)到 $12/时(B300 288GB)— 按每秒计费
- 提示词缓存:4 款模型支持,缓存读取仅 0.1x–0.5x 输入价
- 模型目录:593,766 个开源模型可一键部署到专属端点
- 合规认证:SOC 2 Type II + HIPAA
- 全球覆盖:旧金山 + 首尔双总部,亚太延迟最优
- 适合人群:部署前沿开源模型的团队,特别是亚洲用户
为什么 FriendliAI 值得关注
2026 年的推理 API 市场已由几家美国厂商主导。FriendliAI 打破了地理垄断 — 一家韩国公司以 SOC 2 Type II + HIPAA 合规资质,在亚太基础设施上以有竞争力的价格提供前沿模型推理。对于部署 GLM-5.2、DeepSeek-V3.2 或 Qwen3-235B 的团队,FriendliAI 的价格与美系竞品持平甚至更低。
定价详解(2026-07-25 实时验证)
Model API — 按 Token 计费
| 模型 | 输入 $/1M | 缓存 $/1M | 输出 $/1M |
|---|---|---|---|
| GLM-5.2 / GLM-5.1 | $1.4 | $0.26 | $4.4 |
| DeepSeek-V3.2 | $0.5 | $0.25 | $1.5 |
| Qwen3-235B-A22B | $0.2 | — | $0.8 |
| MiniMax-M2.5 | $0.3 | $0.06 | $1.2 |
| Gemma-4-31B-it | $0.14 | — | $0.4 |
| K-EXAONE-236B | $0.2 | $0.1 | $0.8 |
| Whisper-large-v3 | $0.0015/每分钟音频 | ||
专属 GPU 端点 — 按秒计费
| GPU | 显存 | $/时 |
|---|---|---|
| A100 80GB | 80 GB | $2.9 |
| H100 80GB | 80 GB | $3.9 |
| H200 141GB | 141 GB | $4.5 |
| B200 180GB | 180 GB | $8.9 |
| B300 288GB | 288 GB | $12 |
优势与不足
优势
- 亚太基础设施 — 首尔机房为韩国、日本、东南亚、澳洲提供最低延迟
- 企业级合规 — SOC 2 Type II + HIPAA
- 海量模型支持 — 59 万+ 开源模型一键部署
- 透明定价 — 所有模型价格和 GPU 档次公开,无需登录
- 按秒计费 — 专属端点按实际使用秒数计费
- 提示词缓存 — 缓存读取低至 0.1x 输入价格
不足
- 生态较小 — 第三方集成(LangChain、LlamaIndex)少于美国竞品
- 无免费套餐 — 所有 API 调用从第一天开始收费
- 精选模型有限 — Model API 仅 8 个模型;59 万+ 需专属端点
- 中国市场延迟 — 从中国大陆访问 200–400ms
- 较新入场 — 社区和文档深度不如美国厂商
横向对比
| 对比维度 | FriendliAI | Fireworks AI | Together AI | DeepInfra |
|---|---|---|---|---|
| 总部 | 旧金山 + 首尔 | 美国加州 | 美国加州 | 美国 |
| 合规认证 | SOC 2 Type II + HIPAA | SOC 2 | SOC 2 | SOC 2 |
| 亚太延迟 | ✅ 首尔机房 | ⚠ 仅美西 | ⚠ 仅美西 | ⚠ 仅美欧 |
| 精简模型数 | 8 (API) / 59 万+ (端点) | 100+ | 200+ | 50+ |
| 提示词缓存 | ✅ 4 模型 | ✅ | ✅ | ✅ |
| 专属 GPU | $2.9–$12/时 | $2–$8/时 | $2–$10/时 | 联系销售 |
| 免费套餐 | ❌ 无 | $0.50 额度 | $1 额度 | $0.50 额度 |
使用建议
推荐给:(1)亚洲地区部署前沿开源模型的团队,希望避免经美西路由的延迟——首尔机房在亚太地区表现最佳;(2)需要 SOC 2 Type II 或 HIPAA 合规的企业级推理负载——大多数推理 API 厂商不提供此组合;(3)运行 Hugging Face 长尾开源模型、需要生产级专属端点但不想支付 AWS/GCP 高溢价的团队。
不适合:(1)深度依赖第三方集成(LangChain 文档、LlamaIndex 教程)的开发者——FriendliAI 的生态覆盖较稀疏;(2)希望有免费套餐进行试验的团队;(3)面向中国大陆用户的实时应用。
总结
推荐评级:FriendliAI 是一家值得认真考虑的推理云平台。价格方面 — Gemma-4-31B 的 $0.14/$0.4 与 Fireworks 持平,专属 GPU 从 $2.9/时到 $12/时与美系竞品一致。真正的差异在于地理优势:韩国、日本、新加坡、澳洲团队可获得显著低于美西路由的推理延迟。
免费套餐的缺失和较小的生态是实际代价。但对于合规(SOC 2 + HIPAA)和亚太性能优先于集成数量的生产负载,FriendliAI 是与 Fireworks AI 和 Together AI 并列的有力选择。
Try FreeModel
一个 API Key 路由多个提供商 — DeepSeek + Qwen + Llama + OpenAI 兼容上游。配合 FriendliAI 实现成本最优的开源模型路由。