Helicone (Helicone)

收录于 https://www.helicone.ai

综合排名 #13 ⭐ 可考虑
✅ 开源自部署 + SaaS | 🌍 国际

💰 Token 价格

类型 价格 备注
输入 (Input) 免费层: 10,000 请求/月 + 1GB 存储;Pro $79/月(团队版含告警、HQL 查询);Team $799/月(SOC-2/HIPAA) 每百万 tokens
输出 (Output) 按月订阅 + 用量计费(超过免费额度) 每百万 tokens
💡 免费额度

每月 10,000 次免费请求 + 1GB 存储 (Hobby)

🤖 支持模型(共 100 个)

通过 AI Gateway 代理 100+ Provider 任意模型 AI Gateway + LLM Observability 集成

✨ 优势

  • YC W23 出品,Apache-2.0 开源 LLM Observability 平台
  • 一行代码接入 OpenAI/Anthropic/Google 等 100+ Provider
  • 完整的请求日志、监控、成本归因、Prompt 版本管理
  • HQL (Helicone 查询语言):类 SQL 语法分析 LLM 调用
  • SOC-2 / HIPAA 合规(Team 起步)
  • 支持自部署 + 云端 SaaS 两种模式

⚠️ 不足

  • × 国内访问 SaaS 需代理(自部署无此问题)
  • × 免费层只有 10,000 请求/月
  • × Team 起步 $799/月,价格对中小团队偏高
  • × 高级分析功能需付费层
  • × 自部署版本需要 PostgreSQL + Redis 运维
  • × 相比 Portkey 缺少 A/B Testing 功能深度

🎯 适合场景

需要 LLM 调用深度观测和成本归因的团队;自部署 + SaaS 双模式部署的合规敏感应用;Prompt 实验和版本管理需求

💰 价格与方案

方案价格额度 / 规模最佳用途
Hobby(免费)$0每月 10,000 次免费请求、1 GB 存储、1 席位 1 组织个人开发者和评估 LLM 可观测性的副项目
Pro$79 / 月(叠加用量计费)不限席位、告警与报表、HQL 查询语言需要告警与分析功能的成长型团队
Team$799 / 月(叠加用量计费)5 个组织、SOC-2 与 HIPAA、专属 Slack 频道有合规与审计需求的扩张型企业
Enterprise(企业)合同制定制 MSA、SAML SSO、本地部署、大批量云折扣需要治理、SAML 或气隙自托管的大型组织

🔧 API 与开发者体验

  • 兼容 OpenAI 的透明代理: 把现有 OpenAI/Anthropic SDK 的 baseURL 指向 Helicone,每次调用就会被自动记录、计费并打点——无需学习新 SDK。
  • 支持 100+ Provider 的 AI 网关: 通过统一 API 在 OpenAI、Anthropic、Google Vertex、Groq、Mistral 等之间路由请求,配合 Provider 故障转移和统一可观测性。
  • Apache-2.0 自托管: Helicone 的代理与可观测后端采用 Apache-2.0 许可,可部署在自有 VPC 内——完整数据驻留、无外部遥测。
  • HQL 查询语言: 类 SQL 语法直接查询请求日志:每用户 token 成本、按模型分桶的延迟百分位、按 prompt 模板的失败率——无需自建数据管道。
  • Prompt 缓存与自定义速率限制: 精确缓存与语义缓存命中以接近零成本返回结果;按用户/按 Key 的速率限制以声明式配置,而非通过基础设施代码实现。
  • LLM 安全与内容审核: 内置 prompt 注入检测、PII 脱敏与 OpenAI moderation 路由——这些护栏与请求日志跑在同一个代理层。
  • 原生 Python 与 TypeScript SDK: 提供 Python 与 TypeScript 原生 SDK,以及面向任意 HTTP 客户端的通用 manual logger;LangChain、LlamaIndex、Semantic Kernel 集成开箱即用。

🛰️ 网关与可观测性合二为一的代理

Helicone 的标志性做法,是把 LLM 网关与可观测后端合并到同一个兼容 OpenAI 的代理里。团队只需把 OpenAI 或 Anthropic SDK 的 baseURL 指向 Helicone,就能立即获得请求日志、成本归因、自动重试以及对 100+ 上游模型的 故障转移——无需额外 SDK、单独 trace 管道或同步用的胶水代码。同一套代理既把请求路由到 OpenAI、Anthropic、Vertex、Groq 等上游,也负责记录并执行自定义速率限制与缓存策略。 由于代理本身开源(Apache-2.0)、可观测层与代理是同一二进制,需要完整数据驻留的团队可以把整套栈自托管在国内云上,让每条 prompt 与补全都留在自家 VPC 之内。HQL 进一步把捕获到的请求日志变成可查询的数据集——按用户的 token 花费、按模型的延迟百分位、按 prompt 版本的失败率——无需导出到数仓。统一路由面、开源自托管路径与 SQL 可查询的日志这三者的组合,使 Helicone 在与同类纯可观测工具(Phoenix、LangSmith)和纯网关工具(Portkey、OpenRouter)的竞争中拉开差距。

🌐 中国访问与延迟

Helicone 的部署模式对中国尤为友好,因为代理与可观测后端都采用 Apache-2.0 开源许可。大陆团队可以把整套 Helicone 栈自托管在国内云(如阿里云、腾讯云)或本地机房,完全不接触海外 SaaS 端点——每条 prompt、补全和 trace 都留在中国网络边界内,非常适合数据驻留与合规敏感负载。由于代理与应用部署在一起,既没有按 token 的出站成本,也没有针对中国的速率限流。 托管 SaaS(Helicone Cloud)部署在海外,从大陆访问需要 VPN 或海外中转,典型额外延迟达数百毫秒,不适合生产流量。想要托管体验的团队,主流做法依然是自托管开源版本到国内云并让客户端连接本地代理——代价是需要自行运维 PostgreSQL/Redis,但延迟与访问体验基本等同于在区域内运行。Helicone 不会像许多西方可观测厂商那样施加按地域的调用限流。