闭卷重建检索服务分层与请求生命周期的对象、公式、算例、算法与失败边界。
信息检索与搜索系统 · 小纸条
选一章打印。双面打印(按长边翻页)后沿虚线剪开,每张卡片正面题目、背面答案。
闭卷重建分片、复制与结果合并的对象、公式、算例、算法与失败边界。
闭卷重建缓存键、新鲜度与失效的对象、公式、算例、算法与失败边界。
闭卷重建延迟、吞吐与尾部的对象、公式、算例、算法与失败边界。
闭卷重建可观测性、trace与质量监控的对象、公式、算例、算法与失败边界。
闭卷重建A/B、交错实验与在线指标的对象、公式、算例、算法与失败边界。
闭卷重建生产发布、回滚与容量演练的对象、公式、算例、算法与失败边界。
对象:语料按doc/hash/租户分片,副本提供可用性;协调节点合并各片top-k。;公式:global top-k=top-k(union shard top-k′)。;算例:3个分片各返回top2,共6候选,合并取全局top2;某片超时可能漏冠军。;边界:只取每片top1却全局需多样/过滤;副本索引版本不一致。。
对象:请求经过解析、理解、召回、过滤、排序、摘要/高亮和响应,每层有预算与降级。;公式:T_total=ΣT_stage+queue。;算例:总预算200ms:理解20、召回60、排序80、网络20,剩余20ms给排队/余量。;边界:各层独立重试使尾延迟乘法放大;总超时小于子调用超时。。
对象:平均延迟掩盖慢请求,检索需同时看p50/p95/p99、QPS、超时与降级率。;公式:Little:N≈QPS×latency。;算例:QPS=100、平均响应.2秒,系统平均在途约20请求。;边界:用单请求微基准推线上容量;只报平均值。。
对象:结果/特征/posting缓存必须包含query规范、过滤、权限、索引和模型版本。;公式:key=H(q,filters,acl_version,index_version,ranker_version)。;算例:同query但租户不同不能共享;索引版本升级后旧结果应miss。;边界:缓存键漏ACL泄露数据;长TTL让突发新闻不可见。。
对象:在线实验按用户/会话随机,搜索可用interleaving提高对排序偏好的灵敏度。;公式:lift=(M_T−M_C)/M_C。;算例:对照点击率20%、处理21%,绝对+1点、相对+5%。;边界:按请求随机导致同用户跨组;点击提升来自诱导标题而非满意度。。
对象:日志/指标/trace连接请求、候选、分数、版本和降级;同时监控相关性代理与数据质量。;公式:SLO good/total,error budget=1−SLO。;算例:月SLO99.9%,100万请求允许约1000次不合格。;边界:把原始query/个人信息直接写日志;高基数term打爆指标。。
对象:索引、模型、词典和特征需兼容版本,采用影子/灰度/双读并预演回滚。;公式:capacity_headroom=(capacity−peak)/peak。;算例:容量1200QPS、峰值1000QPS,余量20%。;边界:新索引格式上线后旧服务无法回滚;只测正常流量不测分片失效。。