Every service on every server.全球连接云,让每个应用更快、更安全地服务全球用户。
build 只是第一步,
上线之后才是真正的考验
用户规模上来以后,这些不再只是技术问题:一次超时影响留存,一次白屏影响转化,一次被刷直接影响毛利。以下六种情况在 ToC AI 产品和 Agent 上线后反复出现,每条都写清楚了可以用哪些数据验证。
切后台再回来,多轮对话上下文没了
主力模型超时,客户端已发版改不了
深度研究跑到八成失败,只能从头再来
一万个机器账号各调两次,限流没触发
生成内容越受欢迎,出网账单越高
用户请求经过的每一层,
都在挡掉一类线上问题
从用户点开到内容返回,每一层都有对应的保护动作和成本控制点。可以只启用当前最需要的那一层,其余按用户增长再补。
异常流量在到达业务和模型之前被拦下
攻击、漏洞利用、批量注册和高频调用在边缘处理完,不消耗源站资源,也不产生推理费用。
会话状态单独保存,断线重连不丢上下文
长连接空闲时可以休眠但保持在线,在线连接数因此不再直接等于账单,这是自建长连接服务最难优化的部分。
模型出问题时自动切换,不用等客户端发版
统一配置超时、重试和跨模型回退,同时观测调用量、成本与错误,并可对内容做安全与敏感信息检查。
跑到一半失败,不用从头再来
已完成的步骤不会重复执行,失败步骤按策略重试,需要人工确认时可以安全暂停;不受信任的代码在隔离环境中运行。
全球领先的 AI 公司,
都在用 Cloudflare 支撑增长
从 OpenAI、Anthropic 与 Cloudflare 共同推进生产级 Agent,到拥有 2.6 亿月活用户的 Canva、每天处理 5 亿条消息的 Liveblocks,这些团队用 Cloudflare 加快产品迭代、提升全球访问与安全能力,并持续降低基础设施成本。
OpenAI × Cloudflare
合作与规模OpenAI 将前沿模型直接带入 Cloudflare Agent Cloud,面向 Cloudflare 平台上的数百万企业客户提供服务。
合作价值企业可部署由 GPT-5.4 等模型驱动、可处理真实业务的生产级 Agent;基于 Codex harness 构建的 Agent 可部署至 Cloudflare,兼顾安全、实时响应和全球扩展。
Anthropic × Cloudflare
合作方式Claude Managed Agents 的核心 Agent 循环运行在 Claude 平台,Cloudflare Environments 负责代码执行、私有连接与专用工具,让“智能”与执行环境解耦。
合作价值每个 Agent 会话可获得隔离执行环境,开发者能够通过出站策略、凭据注入和私网连接保护敏感数据,并以日志、会话记录和自定义工具实现可观测、可审计的 Agent 运行。
Canva
业务与规模面向个人和企业的视觉沟通 SaaS,覆盖 190 多个国家,月活用户超过 2.6 亿。
问题与收益在全球增长、攻击高峰和 AI 爬虫抓取下保障速度与用户资产安全;全球体验延迟保持在 50ms 以内,Bot Management 上线后恶意抓取带来的带宽消耗隔夜下降。
Stack Overflow
业务与规模公共开发者问答平台与企业知识 SaaS,服务数百万开发者,边缘安全团队仅 3 人。
问题与收益解决 Layer 7 DDoS 和 AI 爬虫流量激增;一个月完成迁移并消除攻击影响,安全规则调整从按天发布缩短到数分钟。
Fullscript
业务与规模面向医疗从业者的健康管理 SaaS,连续五年应用流量每年翻倍,基础设施团队仅 3 人。
问题与收益遗留 WAF 误报且单次规则修改超过 4 小时;Cloudflare 将修改缩短至 30 秒内,并用 Workers 把原估算 3 至 6 个月的项目缩短至 2 周内。
Liveblocks
业务与规模向软件团队提供实时协作 API 和托管 WebSocket 基础设施,每天处理最高 5 亿条消息。
问题与收益替代难以扩展的容器与数据库架构,实时光标达到每秒 60 帧;WebSocket Hibernation 降低空闲成本并支持可预测定价。
Docker
业务与规模公共镜像生态与付费私有仓库,每月超过 200 万活跃开发者,每天处理超过 5 亿次下载。
问题与收益巨大下载量带来高额 S3 出口费用;缓存命中率从 97% 提升到 99% 以上,Workers 同时为私有镜像下载提供边缘鉴权。
PicsArt
业务与规模移动图像编辑与内容平台,活跃用户超过 9,000 万,每月上传超过 2 亿张图片。
问题与收益解决全球图片分发延迟、带宽消耗和大规模攻击;图片加载速度提升 2 至 3 倍,一个月阻断超过 6.75 亿次威胁。
先解决最紧迫、
风险最高的问题
三条都可以单独开始,不依赖整套架构改造,也不需要迁移现有云上的业务。每条都写清楚了第一步做什么、看哪个指标。
先给一个接口加限流
从注册、登录或生成接口里挑一个最容易被刷的,只设一条最窄的规则。命中量和误伤都能在分析里看到,随时可以关掉。
先把模型调用收到统一入口
配置超时、重试和跨模型回退,客户端不需要改代码,也不用等发版。调用量、成本和错误率在同一个地方看得到。
先接一个域名,不动现有架构
不需要一次性迁移。可以只把边缘防护和 AI 入口接过来,源站保持不变,验证效果之后再决定要不要扩大范围。