8
把 hlsl-perf 的构建时间从 4 分钟压到 40 秒,主要靠这 5 件事
网上关于 hlsl-perf 的文章大多停在「怎么用」,很少有人写「什么时候不该用」。这篇想补上后半句。
关于取舍,我的判断是:如果团队里没有人长期盯这块,就不要引入第二套机制。两套并存的时候,出问题时你甚至要先花时间判断「这次是哪个在起作用」,那个成本比性能损失高得多。
# 压测命令:注意 -c 不要一次拉满,要阶梯上升 # 直接拉满会错过拐点 for c in 50 100 200 400 800; do wrk -t8 -c$c -d60s --latency http://127.0.0.1:8080/api/feed sleep 20 done
真正让我意外的是长尾。平均值一直很漂亮,P99 却在某个阈值之后直接跳了一个数量级。原因不在 hlsl-perf 本身,而是我们上游的连接复用没做好,压测流量太「干净」,掩盖了长尾请求。
最后提醒一个坑:容器环境下一定要记得同步调整内存相关的参数,否则宿主机的限制和进程内部的预期会对不上,表现就是偶发的、无法复现的失败。
顺便说一句,官方文档里这段其实有写,只是藏在一个很不起眼的位置。我是在翻源码注释的时候才发现的,注释里作者解释了为什么这么设计 —— 大意是「为了在极端情况下退化成可预期的行为」。
4 条评论