| 失效链接处理 |
|
为什么越来越多人使用 Apache Solr 10 ?
相关截图:
![]() 主要内容:
先说结论:大家不是为了换版本而换
Solr 用了十几年,站内搜索、电商筛选、日志检索,这些老本行还在。真正让 Solr 10 重新被拿出来讨论的,是一件更现实的事:
业务已经不满足于「关键词命中」,还想要「意思相近也能搜到」。
以前很多人会把关键词搜索留给 Solr / Elasticsearch,再单独搭一套向量库。两套系统、两套数据、两套排障。Solr 10 把向量检索、量化压缩、甚至 GPU 加速都补齐了,关键词和语义可以放在同一个索引里。对中小团队来说,少一套基础设施,比多一个新名词更有吸引力。
2026 年 3 月发布的 Solr 10.0.0,底层换成了 Lucene 10.3,最低要求 Java 21。这不是小修小补,是把搜索能力往前推一截的大版本。
向量检索终于不再像实验功能
Solr 9 其实已经能做向量检索,但用起来总有点「能跑,但不敢放大」。内存吃得厉害,召回想调细一点,参数也不够用。
Solr 10 在这块补了几件很实际的事:
标量量化、二值量化:向量不再只能原样存 float,可以压成更小的表示。内存下来了,检索也会更快,精度会有一点损失,但很多业务完全能接受。
efSearchScaleFactor:以前想搜得更准,往往只能把 topK 调大,结果列表也跟着变长。现在可以多逛一圈候选,最后仍然只返回你要的那 K 条。
可选 GPU 加速:通过 cuVS-Lucene 这个可插拔 codec,向量检索可以吃上 NVIDIA 显卡。
|


苏公网安备 32061202001004号
