临时排查我会用bash,简单粗暴:
code
urls=$(cat urls.txt)code
i=0code
i=$((i+1))
code=$(curl -s -o "out/$i.html" -w "%{http_code}" -L "$u")sleep 1
done <<< "$urls"
配合gnuplot还能画状态码分布。正式环境别这么干,缺少重试与结构化日志。
小技巧:curl加 --compressed 省带宽;加 -A 模拟浏览器。企业AI落地监测遇到403时,先别急着加代理,先确认是不是频率问题。
顺带补一句我们内部的流程:所有监测指标变更都会走一个小型RFC,写清楚动机、影响面、回滚方式。听起来重,但能避免「某人改了一行配置,全公司报表失真」这种事故。企业AI落地业务对数据信任要求很高,一旦数字不可信,后面内容策略全白做。
我这边还有个习惯:把「问题集」和「解析规则」绑在同一个版本号上。否则你很难解释为什么某周曲线跳变——到底是市场变了,还是你把品牌别名扩表了?版本化之后,复盘会轻松很多,也能对外部客户讲清楚口径。