“你们包邮吗?”这样的公共问题每天被问很多遍,很适合拿来思考缓存。可如果问题变成“我的订单能退款吗”,答案就和用户、商品、日期都有关系了。看 Cloudflare AI Gateway,我会先把这两种问答拆开,再去考虑能省多少模型调用。
问法相似,不代表默认会命中缓存
官方当前说明缓存默认关闭,默认匹配依赖整个请求,包括供应商、端点、模型、认证头和完整请求体。它不是自动把所有相似问法归成一个问题。缓存文档目前列支持文本和图片响应。[2]
| 问答类型 | 我会怎样起步 | 更新时先检查什么 |
|---|---|---|
| 固定营业时间 | 使用固定问题与对应内容版本 | 门店和营业时间是否变了 |
| 公共运费政策 | 区分地区、政策版本 | 旧政策能否继续命中 |
| 个人订单状态 | 先保留逐用户读取 | 账号与订单边界是否准确 |
自定义 cf-aig-cache-key 会让相同 key 的请求共享缓存响应。只拿“退款”两个字做 key,就可能把本来不同的条件混在一起。我会把内容版本与允许复用的范围先想清楚;个人订单类任务先绕过缓存,等隔离和更新办法核对好再考虑复用。[2]
核心功能免费,日志要按自己的开户时间查
价格页仍把仪表盘分析、缓存和限流列为免费的核心功能,但日志条件已经分组:2026年9月24日及之后首次创建网关的新客户,按 Workers Logs 的价格与保留规则;此前客户走 Legacy Logs。Guardrails 的评估还会产生 Workers AI 推理用量。[3]
因此,我不会拿旧文章里的日志数量上限给新账号做预算。先看你属于哪一组、打算留多久日志,再把模型调用和其他功能费用分开。排错需要记录,可也没必要一开始就把所有正文长期留下。
跟当前文档选接口,再做一个小范围尝试
导航里的旧 Unified API 路径标了 Deprecated;当前 REST API 仍提供 /ai/v1/chat/completions 等兼容端点。这两条信息放一起看,才不会误以为所有兼容接口都不能用了。[1][4]
如果网站已经在 Cloudflare 上,我会先选一个不涉及个人信息、更新规则明确的公共 FAQ:看正常生成、缓存返回和政策更新后的结果是否都能解释清楚。先证明答案会正确更新,再看命中率,省下的调用才有意义。这里没有本站缓存实验或节省比例实测。
资料核对与适用范围
2026-10-06直接重读所列官方公开资料,从读者任务、计费范围、认证、缓存与运维责任分析取舍;建议场景不冒充本站操作结果。
未登录商家、配置供应商密钥、部署网关、执行模型或工具请求;未测故障回退、预算拦截、缓存命中、权限撤销、性能、真实扣费或归因。具体版本、计划、接入覆盖和账户条件需分别核对。