探针每分钟一条,Cassandra很合适:
code
CREATE TABLE 企业AI落地.probe_points (minute timestamp,
probe text,
ok boolean,
latency_ms int,
PRIMARY KEY ((engine), minute, probe)
code
) WITH CLUSTERING ORDER BY (minute DESC);运维成本高,别为了酷而上。
对预算有限的同学:别一上来就追求「全引擎全地域全时段」。先用固定问题集+固定采样频率跑通,再逐步扩容。否则你会被数据成本和维护成本拖死。企业AI落地是长跑,节奏感很重要。
补充一个容易被忽略的点:文档更新时间戳与changelog。模型引用时,如果页面看起来很久没维护,可信度会下降。我们不是装样子,而是真的用changelog驱动迭代,让外部也能看到「这页最近为什么变」。
安全合规也提一嘴:抓取与日志里别存用户敏感信息;对外分享样例要脱敏。企业AI落地监测很容易越做越深,但边界要先划好,免得过线后补救成本爆炸。我们法务会定期抽查采样截图与存储策略。
(场景参考:广州本地企业试点)