Indi
Measure Zero shiina18.github.io

做企业 RAG 时,最容易被默认接受的一套叙事是:语料大了要上 embedding,复杂问题要上 agent,结构复杂再上 graph RAG。 这篇论文把它们放到同一条、跨度约 450 倍的语料规模曲线上,结论很不客气:小语料时文件系统 Agent 略好;语料约过 1,000 万 token 后,BM25 反超并持续领先。 论文: BM25 Wins at Scale: A Scaling St…

讨论

还没有评论,来说第一句吧。

Measure Zero 的其他文章