设为首页 收藏本站
查看: 1145|回复: 0

[经验分享] Solr的自动完成/自动补充实现介绍(第三部分)

[复制链接]

尚未签到

发表于 2016-12-16 10:11:01 | 显示全部楼层 |阅读模式
原文URL:http://java.dzone.com/news/solr-and-autocomplete-part-3?mz=33057-solr_lucene
在之前的两个部分(part1、part2)中,我们学会了如何配置和查询solr来获取自动完成的功能。今天,我们来看一下如果为suggester添加字段,以这种方式来提供自动完成的功能。
DSC0000.png
组件配置
在上一期的配置组件中添加如下的参数:
<str name="sourceLocation">dict.txt</str>
这样我们的配置就变成了:

<searchComponent name="suggest" class="solr.SpellCheckComponent">
<lst name="spellchecker">
<str name="name">suggest</str>
<str name="classname">org.apache.solr.spelling.suggest.Suggester</str>  
<str name="lookupImpl">org.apache.solr.spelling.suggest.tst.TSTLookup</str>
<str name="field">name_autocomplete</str>
<str name="sourceLocation">dict.txt</str>
</lst>
</searchComponent>
使用这个参数,我们让suggest组件使用名叫dict.txt的文件作为solr的配置字典。
handler配置
handler的配置也需要添加额外的一个参数:
<str name="spellcheck.onlyMorePopular">true</str>

完整的配置为:
<requestHandler name="/suggest" class="org.apache.solr.handler.component.SearchComponent">
<lst name="defaults">
<str name="spellcheck">true</str>
<str name="spellcheck.dictionary">suggest</str>  
<str name="spellcheck.count">10</str>
<str name="spellcheck.onlyMorePopular">true</str>
</lst>
<arr name="components">
<str>suggest</str>
</arr>
</requestHandler>
这个参数告诉solr,当查询的结果数多于设定的count数时,返回点击数更多的那些。
Dictionary
我们告诉solr来使用这个字段,那么这个字段长的什么样呢?下面来看一个例子:
引用

# sample dict
Hard disk hitachi
Hard disk wd    2.0
Hard disk jjdd    3.0


这个字典的结果是什么样的呢?每个词组放在单独的一行中,每行以改词组的权重为结束(权重与词组之间以TAB字符分隔),这个权重就是跟spellcheck.onlyMorePopular=true 香港的参数,默认值为1.0。该字段必须以UTF-8的编码格式存储。每行前有#字符的将被忽略(注释行)。
数据
以这种方式,我们不需要数据,字段就是数据。
运行
在重新构建suggester之后,我们来看一下它的运行情况,输入命令:
引用
/suggest?q=Har

得到的结果为:

<?xml version="1.0" encoding="UTF-8"?>
<response>
<lst name="responseHeader">  
<int name="status">0</int>  
<int name="QTime">0</int>
</lst>
<lst name="spellcheck">
<lst name="suggestions">
<lst name="Dys">   
<int name="numFound">3</int>   
<int name="startOffset">0</int>   
<int name="endOffset">3</int>     
<arr name="suggestion">     
<str>Hard disk jjdd</str>   
<str>Hard disk wd</str>
<str>Hard disk hitachi</str>   
</arr>  
</lst>
</lst>
</lst>
</response>


结束语
跟预期一样,suggest的结果是按权重排序的。这里的大小写敏感(注意首字母).
你有什么建议呢?如果我们有一个很好的字典,这个字典的权重是基于用户的查询行为产生的,那么用户肯定会喜欢它!如果没有好的字典,还是不要用这种方式的好。
下一步
下一期,我们看一下不同方式的suggest产生的索引结构和大小。

运维网声明 1、欢迎大家加入本站运维交流群:群②:261659950 群⑤:202807635 群⑦870801961 群⑧679858003
2、本站所有主题由该帖子作者发表,该帖子作者与运维网享有帖子相关版权
3、所有作品的著作权均归原作者享有,请您和我们一样尊重他人的著作权等合法权益。如果您对作品感到满意,请购买正版
4、禁止制作、复制、发布和传播具有反动、淫秽、色情、暴力、凶杀等内容的信息,一经发现立即删除。若您因此触犯法律,一切后果自负,我们对此不承担任何责任
5、所有资源均系网友上传或者通过网络收集,我们仅提供一个展示、介绍、观摩学习的平台,我们不对其内容的准确性、可靠性、正当性、安全性、合法性等负责,亦不承担任何法律责任
6、所有作品仅供您个人学习、研究或欣赏,不得用于商业或者其他用途,否则,一切后果均由您自己承担,我们对此不承担任何法律责任
7、如涉及侵犯版权等问题,请您及时通知我们,我们将立即采取措施予以解决
8、联系人Email:admin@iyunv.com 网址:www.yunweiku.com

所有资源均系网友上传或者通过网络收集,我们仅提供一个展示、介绍、观摩学习的平台,我们不对其承担任何法律责任,如涉及侵犯版权等问题,请您及时通知我们,我们将立即处理,联系人Email:kefu@iyunv.com,QQ:1061981298 本贴地址:https://www.yunweiku.com/thread-315050-1-1.html 上篇帖子: solr/lucene影响分数的因素 下篇帖子: solr中Schema.xml和solrconfig.xml分析
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

扫码加入运维网微信交流群X

扫码加入运维网微信交流群

扫描二维码加入运维网微信交流群,最新一手资源尽在官方微信交流群!快快加入我们吧...

扫描微信二维码查看详情

客服E-mail:kefu@iyunv.com 客服QQ:1061981298


QQ群⑦:运维网交流群⑦ QQ群⑧:运维网交流群⑧ k8s群:运维网kubernetes交流群


提醒:禁止发布任何违反国家法律、法规的言论与图片等内容;本站内容均来自个人观点与网络等信息,非本站认同之观点.


本站大部分资源是网友从网上搜集分享而来,其版权均归原作者及其网站所有,我们尊重他人的合法权益,如有内容侵犯您的合法权益,请及时与我们联系进行核实删除!



合作伙伴: 青云cloud

快速回复 返回顶部 返回列表