CHEN TECH STUDIO
个人技术展示与项目记录
技术笔记
单纯依赖余弦向量检索常常遇到专有名词漏召回。本文分享 BM25 稠密检索结合 Cross-Encoder Rerank 的落地方案。
感谢阅读本文
如果你觉得内容有帮助,欢迎点赞支持或分享给同行开发者。
自回归模型逐个生成 token。
稀疏专家模型并非每个 token 都运行全部专家。
将潜空间图像切成 patch 后,Transformer 处理的是 token 序列。