从 0 到 1 用 esp32-review 搭建内部平台:架构图与决策记录
先说背景。我们的场景是 esp32-review + 三个下游服务,日均请求量七位数,峰值集中在晚上九点前后。
监控这块我们也顺手改了:把原来的平均值告警换成分位数,并且按接口拆分。改完之后误报少了大概七成,值班同学的怨气肉眼可见地下降了。
顺便说一句,官方文档里这段其实有写,只是藏在一个很不起眼的位置。我是在翻源码注释的时候才发现的,注释里作者解释了为什么这么设计 —— 大意是「为了在极端情况下退化成可预期的行为」。