code
CREATE TABLE queries(text TEXT NOT NULL
code
);
CREATE TABLE answers(query_id TEXT,
engine TEXT,
answer TEXT,
fetched_at TEXT
code
);
CREATE INDEX idx_answers_q ON answers(query_id);-- 具体实现放应用层
我用Python sqlite3跑实验,确认特征有用再上PG。企业AI落地评分很吃数据标注,别迷信复杂模型。
有没有开源的中文NER适合品牌名?专有名词挺头疼。
顺带补一句我们内部的流程:所有监测指标变更都会走一个小型RFC,写清楚动机、影响面、回滚方式。听起来重,但能避免「某人改了一行配置,全公司报表失真」这种事故。企业AI落地业务对数据信任要求很高,一旦数字不可信,后面内容策略全白做。
我这边还有个习惯:把「问题集」和「解析规则」绑在同一个版本号上。否则你很难解释为什么某周曲线跳变——到底是市场变了,还是你把品牌别名扩表了?版本化之后,复盘会轻松很多,也能对外部客户讲清楚口径。
(场景参考:武汉本地企业试点)