一行代码,接入完整LLM可观测性
Helicone(helicone.ai)的接入文档里有一句话说得很准确:“你只需要改两行代码”。
以Claude为例:
# 改之前
from anthropic import Anthropic
client = Anthropic(api_key="你的Anthropic Key")
# 改之后(加两行)
from anthropic import Anthropic
client = Anthropic(
api_key="你的Anthropic Key",
base_url="https://anthropic.helicone.ai", # 改这里
default_headers={"Helicone-Auth": "Bearer 你的Helicone Key"} # 加这行
)
代码逻辑不动,模型调用不变,账单仍然结算给Anthropic,但每一次调用都自动记录在Helicone的Dashboard里——输入输出内容、延迟、Token用量、成本估算,一目了然。
0%加价的含义
“0%加价”是Helicone区别于大多数中转站的核心特征。
常见的中转站商业模式:你给中转站付钱,中转站付给API提供商,中间存在差价(即”加价”)。很多国内中转站明确声称”官方价格”,但实际上也有汇率差和服务费包含在其中。
Helicone的模式不同:你直接持有Anthropic/OpenAI等的API Key,Helicone充当代理层,请求经过Helicone转发,Helicone记录日志并向你收取平台服务费(免费层1万请求/月,付费层$79/月起)。你的API成本直接从你的Claude/OpenAI账户扣,Helicone只收观测工具的钱。
这意味着:
- 你不需要担心Helicone上游的模型Key是否可靠
- 你的Anthropic账户关系不受影响,用量统计仍在官方Dashboard可见
- 如果Helicone服务出问题,切回原始base_url即可
开源版本:数据留在你的服务器
Helicone的整个平台代码在GitHub(helicone-ai/helicone)完全开源,企业用户可以在自己的Kubernetes集群或云服务器上部署:
# Docker Compose快速启动
git clone https://github.com/Helicone/helicone
cd helicone/docker
docker-compose up -d
自部署版本的优势:
- LLM调用日志不离开你的基础设施
- 满足金融/医疗/政务等数据驻留要求
- 无SaaS服务费(只有基础设施成本)
- 可定制Dashboard和告警逻辑
核心功能一览
请求追踪:每次LLM调用完整记录,包括完整的输入/输出内容(可配置是否脱敏)、延迟、模型版本。
成本分析:按时间、模型、API Key、自定义属性(如用户ID、功能模块)统计Token用量和成本。可以回答”上个月哪个功能用了最多钱”。
会话追踪:把多次LLM调用标记为同一会话(如一次对话的多轮交互),在Dashboard里可视化完整对话链路。
实验室(Playground):基于已有真实请求的数据,测试不同Prompt版本或模型的效果对比,无需额外构造测试数据。
告警:设置成本、错误率、延迟阈值,超出时发Webhook或邮件通知。
Helicone vs. Portkey:选哪个
两者定位相近但重点不同:
| 维度 | Helicone | Portkey |
|---|---|---|
| 接入复杂度 | 极低(2行代码) | 中等(需了解Virtual Key) |
| 护栏/Guardrails | 无内置 | 50+规则 |
| 模型路由 | 无 | 有(负载均衡/降级) |
| 开源自部署 | 支持 | 支持 |
| 数据不加价 | 是 | 是 |
| 免费层 | 1万请求/月 | 1万条日志/月 |
选Helicone的场景:想要最简单的接入、有数据驻留要求需要自部署、不需要护栏和路由功能。
选Portkey的场景:需要内容安全护栏、需要多模型路由/负载均衡、需要更大免费层。
如果你只是想有个地方看LLM调用日志和成本,Helicone是最快的选择——改两行代码,5分钟后Dashboard里就有数据了。
本文信息核实日期:2026-08-11,开源版本部署文档以helicone-ai/helicone GitHub仓库为准,SaaS定价以helicone.ai/pricing为准。
相关推荐
- Replicate:开源模型聚合+自定义模型部署,图像/视频生成主力平台,支持私有模型发布
- KoalaAPI:海外主流模型集成专长(Gemini/ChatGPT/Claude),Claude 4.5 成功率宣称 99.7%+
- Not Diamond:业界SOTA智能路由,自动选最优模型,降本保质
- Chutes:全球低延迟多模型路由,A/B测试友好,价格竞争性
快速信息卡
| 定价模式 | Hobby免费层(每月1万请求)+ Pro $79/月起 + Team $799/月 + 企业定制;0%模型Token加价,仅收平台服务费;开源版本可自部署 |
|---|---|
| 模型覆盖 | Claude/GPT/Gemini/Llama等所有主流大模型(充当代理层,不限制模型) |
| 延迟/SLA | 代理转发,官方宣称额外延迟<20ms;全球多地区节点 |
| 国内直连 | 需代理 |
| 适用场景 | 开发者 / 企业 |
| 邀请/返利计划 | 暂未发现公开联盟计划。 |
优点
- 0%模型加价:Helicone只收平台观测服务费,不对模型Token成本加价,不影响你和Anthropic/OpenAI的直接结算
- 开源+自部署:代码完全开源(GitHub: helicone-ai/helicone),可在自己服务器上部署,数据不离境
- 最小侵入式接入:只需修改base_url,一行代码完成接入,不改动任何业务逻辑
缺点
- SaaS版需要科学上网,自部署版需要运维能力
- 功能深度不如Portkey(没有内置护栏/Guardrails,也不做模型路由)
- 高用量SaaS版本收费不低,超出免费层后按请求数计费