Retrieval Paths
8/3/26About 2 min
Retrieval Paths
召回路径定义候选从哪里来、服务哪一种用户意图,以及在总候选预算中占多少份额。多路召回不是路径越多越好,而是要让每条路径贡献独特、可衡量、可降级的增量价值。
路径设计模板
| 项目 | 需要回答的问题 |
|---|---|
| Target | 哪类用户、场景或意图会触发? |
| Source | 索引、行为图、缓存还是规则库? |
| Signal | 使用长期兴趣、当前会话还是关系信号? |
| Budget | 候选数、超时和计算预算是多少? |
| Filter | 可见性、地域、时效和安全规则在哪里执行? |
| Fallback | 路径失败或结果不足时回退到什么? |
| Metric | 如何证明它提供了独特增量? |
常见路径组合
- 长期兴趣:ItemCF、图嵌入和双塔,覆盖稳定偏好;
- 短期意图:最近点击 I2I、query/session embedding,响应兴趣漂移;
- 关系信号:关注作者、相似作者和好友互动;
- 上下文信号:位置、时间、设备与当前入口;
- 供给治理:新品、长尾、高质量或创作者扶持;
- 兜底路径:分人群热门、缓存结果与运营精选。
固定配额易理解,但可能浪费候选预算;动态配额可以依据活跃度、兴趣置信度、路径近期收益和系统负载调整,但必须设置上下界,避免反馈回路让某条路径永久失去曝光。
增量评估
除单路径 Recall@K 外,还要看它对候选并集的边际贡献:
线上可通过关闭路径、缩减配额或影子召回评估真实增益。若移除路径后业务指标不变,它可能只是复制了其他路径;若只对特定人群有效,应转为条件触发而非全量运行。
