1.什么是solr
solr是Apache下的一个顶级开源项目,采用Java开发,它是基于Lucene的全文检索服务器。Solr提供了比lucene风味丰富的查询语言,同时实现了可配置,可扩展,并对索引,搜索性能进行优化。
Solr可以独立运行,运行在Jetty,Tomcat等这些Servlet容器中,solr索引的实现方法很简单,用POST方法享Solr服务器发送一个藐视Field及其内容的XML文档,Solr根据XML文档添加,删除,更新索引。Solr搜索只需要发送HTTP GET请求,然后对Solr返回XML,json等格式的查询结果进行解析,组织页面布局。Solr不提供构建UI的功能。Solr提供了一个管理界面,通过管理界面可以查询solr的配置和运行情况。
2.Solr与Lucene的区别
Lucene是一个开放源代码的全文检索引擎工具包,它不是一个完整的全文检索引擎。Lucene提供了完整的查询引擎和索引引擎,目的是为了软件开发人员提供一个简单易用的工具包,以方便的在目标系统中实现全文检索的功能,或者以Lucene为基础构建全文检索引擎。
Solr的目标是打造一款企业级的搜索引擎系统,他是一个搜索引擎服务,可以独立运行,通过solr可以非常快速的构建企业的搜索引擎,通过solr也可以搞笑的完成站内搜索功能。
Solr原理图
3. Solr安装及配置
3.1 官网下载:https://mirrors.tuna.tsinghua.edu.cn/apache/lucene/solr
3.2 solr4.10.3的目录结构
bin:solr的运行脚本
contrib:solr的一些贡献软件/插件,用于增强solr的功能
dist:该目录包含build过程汇总产生的war和jar文件,以及相关的依赖文件。
docs:solr的API文档
example:solr工程的例子目录:
example/solr:
该目录三十一个包含默认配置信息的solr的core目录
example/muticore:
该目录包含了在solr的multicore中设置的多个Core目录
example/webapps:
该目录中包括了一个solr.war,该war可作为solr的运行实例工程。
licenses:solr相关的一些许可信息
3.3.solr运行环境
solr需要运行在一个Servlet容器中,Solr4.10.3要求jdk使用1.7以上;solr默认提供jetty(java写的Servlet容器),在这使用tomcat作为servlet容器。
Solr整合tomcat
第一步:先将\solr\solr-4.10.3\example\webapps下的solr.war 复制粘贴到tomcat的webapps下,并解压删除。
第二步:再将solr-4.10.3\example\lib\ext文件夹下的所有jar包copy到第一步解压好的solr\WEB-INF\lib下
第三步:创建一个solrhome文件夹,将\solr-4.10.3\example\solr下的所有文件全部copy到solrhome文件夹下
第四步:修改tomcat中webapps下的webapps\solr\WEB-INF\web.xml
第五步:启动tomcat
效果: