跳转到内容
搜索文档

更新日志

Cloudflare 的最新更新与改进。

在 AI Gateway 日志中查看请求的用户代理(User Agent)

AI Gateway 日志现在能够捕获发起每个请求的客户端的用户代理(User Agent),从而更容易识别是哪个 SDK、库或应用程序发送了流经您网关的流量。例如,您可以区分来自 openai-python 的请求与来自自定义应用程序或 Cloudflare Worker 的请求。

用户代理会与每个日志条目中的其他详细信息一起显示,并且您可以在仪表板中按用户代理(等于、不等于或包含)对日志进行筛选。

欲了解更多信息,请参阅日志记录

使用支出限制控制 AI 成本

AI Gateway 现在支持支出限制(spend limits)——基于成本的预算,可追踪累计美元支出,并在超出预算时拦截请求。与限制请求次数的速率限制不同,支出限制是基于 Token 使用量和模型定价来追踪实际成本。

您可以按模型、提供商或自定义元数据维度来限定限制范围。例如,为每个用户分配每日 200 美元的预算,将网关总支出限制在每日 10,000 美元以内,或者限制每个用户对特定模型的每日支出上限为 50 美元。每条规则都使用可配置的时间窗口,可采用固定或滑动执行策略。

支出限制适用于具有已知定价模型的 统一计费(Unified Billing)BYOK(自带密钥) 请求。

欲了解更多细节,请参阅支出限制文档

通过 AI Gateway 全新的 REST API 调用任何 AI 模型

AI Gateway 现在开始使用 api.cloudflare.com 上的 AI REST API。无论提供商是 OpenAI、Anthropic、Google 还是托管在 Workers AI 上,您都可以通过一个统一的 API 调用任何模型,并使用相同的端点和身份验证方式。共有四个端点可用:

  • POST /ai/run — 适用于所有模型和模态的通用端点
  • POST /ai/v1/chat/completions — 兼容 OpenAI SDK
  • POST /ai/v1/responses — 兼容 OpenAI Responses API
  • POST /ai/v1/messages — 兼容 Anthropic SDK
curl -X POST "https://api.cloudflare.com/client/v4/accounts/$CLOUDFLARE_ACCOUNT_ID/ai/v1/chat/completions" \
  --header "Authorization: Bearer $CLOUDFLARE_API_TOKEN" \
  --header "Content-Type: application/json" \
  --data '{
    "model": "openai/gpt-5.5",
    "messages": [{"role": "user", "content": "What is Cloudflare?"}]
  }'

所有的 AI Gateway 功能(日志记录、缓存、速率限制和护栏)都会自动应用。第三方模型将通过统一计费(Unified Billing)进行计费,因此您无需管理单独的提供商 API 密钥。

第三方模型请求将通过您账户的默认网关(Gateway)进行路由,该网关会在首次使用时自动创建。若要通过特定网关路由请求,请添加 cf-aig-gateway-id 标头。

如果您已经通过现有的 REST API 调用 Workers AI 模型,该路径(/ai/run/@cf/{model})将继续有效。若要通过 AI Gateway 调用 Workers AI 模型,请使用 @cf/ 模型前缀(例如,@cf/moonshotai/kimi-k2.6)并包含 cf-aig-gateway-id 标头来指定要路由到的网关。

欲了解更多细节和示例,请参阅 REST API 文档