以编程方式使用文档

LLM 网关是一个代理,位于您的代理(或任何 LLM 客户端)与其调用的 LLM 提供商之间。密钥不再由每个客户端在本地存储提供商 API 密钥,而是作为提供商密钥在 LangSmith 中存储一次。客户端使用 LangSmith API 密钥.

当请求通过网关时,它会:

  1. 使用调用方的 LangSmith API 密钥对调用方进行身份验证。
  2. 从您工作区的提供商密钥中解析实际的提供商 API 密钥。
  3. 评估治理策略(消费限制、个人信息删除、密钥删除)。
  4. 将请求代理到上游提供商。
  5. 将调用追踪到 LangSmith。

每个通过网关代理的调用都作为 追踪 出现在 LangSmith 中。当策略触发时,事件流入 LangSmith Engine 进行分类——您可以从被阻止的请求转到触发它的追踪再到修复,全部在一个产品中完成。

功能可用性

功能描述
**消费限制**组织, 工作区, API 密钥层级强制硬性阻止。当达到上限时,调用方会收到 402 响应以及可操作的错误消息。
**消费可见性**按工作区、用户、API 密钥汇总的实时成本。通过自定义图表可以获得按模型的可见性。
**个人信息删除**在请求到达模型之前检测并删除其中的姓名、地点、国籍、宗教、政治派别和年龄。
**密钥删除**检测并删除请求中的美国电话号码、美国社会安全号码、API 密钥、令牌和凭证。覆盖 AWS、GitHub、GitLab、OpenAI、Anthropic、GCP、Azure、Slack、Datadog、PyPI、npm、私钥和 LangSmith 令牌。
**LangSmith Engine 集成**策略违规在 LangSmith Engine 中显示为问题。单击可从违规追溯到生成它的追踪。
**审计日志**网关配置的管理变更和网关调用都会被记录。
**追踪**每个通过网关代理的调用都出现在与您代理其他追踪相同的 LangSmith 工作区中。通过网关路由不会分散您的可观测性。

支持的提供商

提供商网关路径密钥名称
Anthropic/anthropicANTHROPIC_API_KEY
AWS Bedrock/bedrockAWS_BEARER_TOKEN_BEDROCK
Baseten/basetenBASETEN_API_KEY
Fireworks/fireworksFIREWORKS_API_KEY
Google Gemini/geminiGOOGLE_API_KEY
Google Vertex AI/vertexVERTEX_SERVICE_ACCOUNT_JSON
OpenAI/openaiOPENAI_API_KEY

已知限制

  • Claude Desktop: 不支持市场插件。聊天标签不可见,但协作功能正常。
  • Codex Desktop: 不支持市场插件。
  • Cursor: IDE 集成尚不可用。
  • ChatGPT Desktop / Gemini Desktop: 不可配置。

资源

Spend policies

在整个组织中设置和管理成本限制。

PII and secrets redaction

防止敏感数据被发送到 LLM 提供商或追踪存储。

如有关于 LLM Gateway 的其他问题,请联系 support.langchain.com.