要构建和部署 AI 应用程序,您需要用于应用程序逻辑的计算,运行推理的方法,以及管理跨提供商成本的网关。Cloudflare Workers 托管您的应用程序逻辑并为您的前端提供服务。Workers AI 通过按次计费在边缘运行推理。AI Gateway 添加了跨 OpenAI、Anthropic 和其他提供商的缓存、速率限制和可观测性。Durable Objects 协调有状态的工作流和多轮对话。
在 Cloudflare 全球网络上构建和部署无服务器应用程序。了解有关 Workers 的更多信息。
- 流式响应 - 随着响应的生成,逐个 token 地流式传输 AI 响应,无需缓冲完整的回复
- 全栈部署 - 从单个部署提供前端和后端服务,无需管理单独的基础架构
通过 Workers 绑定,在 Cloudflare 的全球网络上运行推理,并按次计费。了解有关 Workers AI 的更多信息。
- 全球推理 - 在离用户最近的 Cloudflare 节点运行模型,减少往返延迟
- 按次计费定价 - 没有 GPU 预留或空闲成本;只需按处理的 token 付费
使用缓存、速率限制和统一分析将请求代理到任何 AI 提供商。了解有关 AI Gateway 的更多信息。
- 提供商灵活性 - 通过单一端点将请求路由到 OpenAI、Anthropic、Workers AI 或任何其他提供商
- 统一的可观测性 - 在一个地方跨所有提供商跟踪请求量、延迟、成本和错误
具有强一致性存储和协调的有状态对象。了解有关 Durable Objects 的更多信息。
- 有状态工作流 - 协调多步 AI 管道并跨请求维护对话状态