Visual LabINTERACTIVE LEARNING
06 · SAAS OPERATIONSP113 MIN

Cache-Control 与 API Latency

用缓存语义管理新鲜度,并把 API 总时延拆成可定位的阶段。

MENTAL MODELCACHING & LATENCY
01DNS/TLS
02Edge
03App Queue
04DB
05Third-party
06Response
总时延是 DNS、连接、排队、应用、数据库、第三方和传输的和;只看“请求 2 秒”无法优化。
01 · CONCEPTS & BOUNDARIES

先把概念与边界说清楚

定义告诉你它是什么,边界告诉你它不负责什么;企业系统最常见的误解通常发生在两者混用时。

01

Cache-Control

通过 max-age、s-maxage、private、no-cache、no-store 等指令定义缓存行为。

02

API Latency

从客户端发出到拿到响应的时间,可用 p50/p95/p99 观察典型与长尾。

03

Static vs API Optimization

静态资源侧重体积、压缩、边缘缓存;API 侧重连接、计算、查询、缓存与依赖。

02 · BLIND BOTS CASE

API p50 120ms,p95 却 3s

问题现场

平均值看起来正常,美国少量请求经常卡住。

  1. 01

    按区域、端点和租户分组 p95。

  2. 02

    Trace 显示地址校验第三方长尾。

  3. 03

    设置超时、缓存稳定结果并异步补充非关键字段。

得到什么

优化针对长尾来源,不再用扩容应用服务器掩盖外部依赖。

03 · PRACTICE

马上动手

  1. 为公共 Catalog API 写 Cache-Control。
  2. 把 2 秒 API 拆成至少五个计时段。
04 · PITFALLS

常见坑

  • 只看平均响应时间
  • 私密 API 配 public cache
  • 把 no-store 与 no-cache 混淆
05 · KNOWLEDGE CHECK静态资源和 API 应如何分别优化?查看答案⌄
答案

静态资源用压缩、拆分、内容哈希与 CDN;API 先用指标/Trace 拆解服务、数据库和依赖,再针对缓存、查询、并发或区域部署优化。