关于 editor-books 的选型,我把 5 个方案做成了对照表
网上关于 editor-books 的文章大多停在「怎么用」,很少有人写「什么时候不该用」。这篇想补上后半句。
# 压测命令:注意 -c 不要一次拉满,要阶梯上升 # 直接拉满会错过拐点 for c in 50 100 200 400 800; do wrk -t8 -c$c -d60s --latency http://127.0.0.1:8080/api/feed sleep 20 done
关于取舍,我的判断是:如果团队里没有人长期盯这块,就不要引入第二套机制。两套并存的时候,出问题时你甚至要先花时间判断「这次是哪个在起作用」,那个成本比性能损失高得多。
监控这块我们也顺手改了:把原来的平均值告警换成分位数,并且按接口拆分。改完之后误报少了大概七成,值班同学的怨气肉眼可见地下降了。
真正让我意外的是长尾。平均值一直很漂亮,P99 却在某个阈值之后直接跳了一个数量级。原因不在 editor-books 本身,而是我们上游的连接复用没做好,压测流量太「干净」,掩盖了长尾请求。