|
|
1
0
这里的罪魁祸首是StandardAnalyzer/tokenizer——它尽可能使URL可搜索,但在这种情况下,它将不匹配部分主机名。标准的方法是创建一个自定义的分析器/记号赋予器-为此,我可以向您指出另一个 SO question with a similar problem and solution . |
|
|
2
0
您要为索引编写器指定哪个分析器?如果用错误的方法标记一个字段,告诉Lucene标记它对您没有任何好处。对于你想要的,听起来你需要确保你的记号赋予器在“.”上分裂,也许它也在生成n-gram(后者可能不是必需的)。您应该更深入地研究各种可用的分析程序,看看哪种标记化技术行为最接近您想要的。否则,您可以始终编写自定义分析器。确保使用与搜索相同的分析器进行索引,因此如果索引“domain1.co.uk”(变为“domain1 co uk”)并搜索“domain1.co”(变为“domain co”),则会在其中找到匹配项,而未命名的查询“domain1.co”将不匹配。 |
|
|
Singaravelu · Lucene。带“#”的网络搜索不起作用 9 年前 |
|
|
jan · Lucene中空值的自定义排序。Net 3.0.3 9 年前 |
|
|
KMX · 应对巨大流量-在线票务网站 12 年前 |