从信息需求、相关性与测试集建立可证伪的检索目标。
7 讲把多语言原始内容变成可反查的token、字段与版本。
8 讲从词典、posting和位置走到分块构建、增量合并与压缩。
8 讲用集合、位置和查询计划完成正确、安全的候选检索。
7 讲从词袋、权重和余弦相似度走到稀疏top-k评分。
7 讲推导BM25、字段权重与查询似然,并解释参数边界。
8 讲用AP、NDCG、配对统计和查询级分析定位系统失败。
7 讲处理拼写、实体、会话、补全和扩展的收益与伤害。
7 讲从pointwise、pairwise、listwise走到负例偏置和消融。
7 讲构建embedding、ANN、混合召回和cross-encoder重排。
7 讲处理分片、缓存、延迟、观测、A/B和发布回滚。
7 讲交付语料、索引、排序、评价、安全、部署和答辩闭环。
7 讲