FriendliAI 2026 评测:前沿推理 API 与专属 GPU 端点

FriendliAI 是一家韩国总部的前沿推理云平台,提供两类核心服务:按 Token 计费的 Model API(适用于前沿开源模型)和按秒计费的专属 GPU 端点(已获 SOC 2 Type II 和 HIPAA 合规认证)。其定价页面无需登录即可查看所有模型价格,模型目录涵盖 Hugging Face 上 59 万+ 开源模型。

与 Fireworks AI 或 Together AI 等美国竞争对手相比,FriendliAI 的独特优势在于亚太基础设施(首尔机房)和一套清晰的定价模型 — 从单次 API 调用到多 GPU B300 集群,按实际用量付费。

核心要点

  • Model API:输入从 $0.14/百万起(Gemma-4-31B),输出最高 $4.4/百万(GLM-5.2)— 按 Token 计费,无最低消费
  • 专属端点:从 $2.9/时(A100)到 $12/时(B300 288GB)— 按每秒计费
  • 提示词缓存:4 款模型支持,缓存读取仅 0.1x–0.5x 输入价
  • 模型目录:593,766 个开源模型可一键部署到专属端点
  • 合规认证:SOC 2 Type II + HIPAA
  • 全球覆盖:旧金山 + 首尔双总部,亚太延迟最优
  • 适合人群:部署前沿开源模型的团队,特别是亚洲用户

为什么 FriendliAI 值得关注

2026 年的推理 API 市场已由几家美国厂商主导。FriendliAI 打破了地理垄断 — 一家韩国公司以 SOC 2 Type II + HIPAA 合规资质,在亚太基础设施上以有竞争力的价格提供前沿模型推理。对于部署 GLM-5.2、DeepSeek-V3.2 或 Qwen3-235B 的团队,FriendliAI 的价格与美系竞品持平甚至更低。

定价详解(2026-07-25 实时验证)

Model API — 按 Token 计费

模型输入 $/1M缓存 $/1M输出 $/1M
GLM-5.2 / GLM-5.1$1.4$0.26$4.4
DeepSeek-V3.2$0.5$0.25$1.5
Qwen3-235B-A22B$0.2$0.8
MiniMax-M2.5$0.3$0.06$1.2
Gemma-4-31B-it$0.14$0.4
K-EXAONE-236B$0.2$0.1$0.8
Whisper-large-v3$0.0015/每分钟音频

专属 GPU 端点 — 按秒计费

GPU显存$/时
A100 80GB80 GB$2.9
H100 80GB80 GB$3.9
H200 141GB141 GB$4.5
B200 180GB180 GB$8.9
B300 288GB288 GB$12

优势与不足

优势

  • 亚太基础设施 — 首尔机房为韩国、日本、东南亚、澳洲提供最低延迟
  • 企业级合规 — SOC 2 Type II + HIPAA
  • 海量模型支持 — 59 万+ 开源模型一键部署
  • 透明定价 — 所有模型价格和 GPU 档次公开,无需登录
  • 按秒计费 — 专属端点按实际使用秒数计费
  • 提示词缓存 — 缓存读取低至 0.1x 输入价格

不足

  • 生态较小 — 第三方集成(LangChain、LlamaIndex)少于美国竞品
  • 无免费套餐 — 所有 API 调用从第一天开始收费
  • 精选模型有限 — Model API 仅 8 个模型;59 万+ 需专属端点
  • 中国市场延迟 — 从中国大陆访问 200–400ms
  • 较新入场 — 社区和文档深度不如美国厂商

横向对比

对比维度FriendliAIFireworks AITogether AIDeepInfra
总部旧金山 + 首尔美国加州美国加州美国
合规认证SOC 2 Type II + HIPAASOC 2SOC 2SOC 2
亚太延迟✅ 首尔机房⚠ 仅美西⚠ 仅美西⚠ 仅美欧
精简模型数8 (API) / 59 万+ (端点)100+200+50+
提示词缓存✅ 4 模型
专属 GPU$2.9–$12/时$2–$8/时$2–$10/时联系销售
免费套餐❌ 无$0.50 额度$1 额度$0.50 额度

使用建议

推荐给:(1)亚洲地区部署前沿开源模型的团队,希望避免经美西路由的延迟——首尔机房在亚太地区表现最佳;(2)需要 SOC 2 Type II 或 HIPAA 合规的企业级推理负载——大多数推理 API 厂商不提供此组合;(3)运行 Hugging Face 长尾开源模型、需要生产级专属端点但不想支付 AWS/GCP 高溢价的团队。

不适合:(1)深度依赖第三方集成(LangChain 文档、LlamaIndex 教程)的开发者——FriendliAI 的生态覆盖较稀疏;(2)希望有免费套餐进行试验的团队;(3)面向中国大陆用户的实时应用。

总结

推荐评级:FriendliAI 是一家值得认真考虑的推理云平台。价格方面 — Gemma-4-31B 的 $0.14/$0.4 与 Fireworks 持平,专属 GPU 从 $2.9/时到 $12/时与美系竞品一致。真正的差异在于地理优势:韩国、日本、新加坡、澳洲团队可获得显著低于美西路由的推理延迟。

免费套餐的缺失和较小的生态是实际代价。但对于合规(SOC 2 + HIPAA)和亚太性能优先于集成数量的生产负载,FriendliAI 是与 Fireworks AI 和 Together AI 并列的有力选择。

Try FreeModel

一个 API Key 路由多个提供商 — DeepSeek + Qwen + Llama + OpenAI 兼容上游。配合 FriendliAI 实现成本最优的开源模型路由。

获取免费额度 →