使用solrj操作solr索引库

(solrj)初次使用solr的开发人员总是很郁闷,不知道如何去操作solr索引库,以为只能用《五分钟solr4.5教程(搭建、运行)》中讲到的用xml文件的形式提交数据到索引库,其实没有那么麻烦,solr配套有好多的客户端用于操作索引库,下面我们来讲如何用solrj去操作solr索引库。

一、认识solrj

solrj是solr的java客户端,用于访问solr索引库。它提供了添加、删除、查询、优化等功能。

二、下载

百度、google以下solrj下载,你会发现根本就没有,那么我们该到哪儿下载呢?其实,它是集成到solr压缩包里的,解压文件后,有个目录/dist/solrj-lib,里面就存放了solrj所用到的jar,你把这些jar都添加到你的classpath就ok。

如果你是使用Maven来构建项目,添加以下代码到你的pom.xml配置文件中:

<dependency>
        <artifactId>solr-solrj</artifactId>
        <groupId>org.apache.solr</groupId>
        <version>1.4.0</version>
        <type>jar</type>
        <scope>compile</scope>
</dependency>
<dependency>
        <groupId>org.slf4j</groupId>
        <artifactId>slf4j-simple</artifactId>
        <version>1.5.6</version>
</dependency>

三、创建SolrServer

1、HttpSolrServer

solrj是采用http请求的方式去访问solr索引库的,首先我们得先创建一个HttpSolrServer,如下:

String url = "http://localhost:8983/solr";//8983是web服务器的端口号,需要根据情况进行调整
SolrServer server = new HttpSolrServer( url );

以上使用默认的方式创建server,你也可以配置其他的连接参数:

String url = "http://localhost:8983/solr" ;
HttpSolrServer server = new HttpSolrServer( url ); server.setMaxRetries(1); // defaults to 0. > 1 not recommended. server.setConnectionTimeout(5000); // 5 seconds to establish TCP
// Setting the XML response parser is only required for cross
 // version compatibility and only when one side is 1.4.1 or
// earlier and the other side is 3.1 or later. server.setParser(new XMLResponseParser());
// binary parser is used by default
// The following settings are provided here for completeness.
// They will not normally be required, and should only be used
 // after consulting javadocs to know whether they are truly required.
server.setSoTimeout(1000); // socket read timeout
server.setDefaultMaxConnectionsPerHost(100);
server.setMaxTotalConnections(100);
server.setFollowRedirects(false); // defaults to false
// allowCompression defaults to false.
// Server side must support gzip or deflate for this to have any effect.
server.setAllowCompression(true);

2、EmbeddedSolrServer

EmbeddedSolrServer提供了和HttpSolrServer一样的接口,区别是EmbeddedSolrServer没有通过http连接。

//Note that the following property could be set through JVM level arguments too
System.setProperty("solr.solr.home", "d:/solr_home/solr"); //此处配置solr home,根据自己的情况修改
CoreContainer.Initializer initializer = new CoreContainer.Initializer();
CoreContainer coreContainer = initializer.initialize();
EmbeddedSolrServer server = new EmbeddedSolrServer(coreContainer, "");

当然实际中可能不止一个core,那么采用如下方式:

File home = new File( "d:/solr_home/solr" );//此处配置solr home,根据自己的情况修改
File f = new File( home, "solr.xml" );

CoreContainer container = new CoreContainer();

container.load( "d:/solr_home/solr", f );

EmbeddedSolrServer server = new EmbeddedSolrServer( container, "core name as defined in solr.xml" );//双引号配置你的core名字
...

在嵌入式的应用中使用solr,推荐使用EmbeddedSolrServer。

注意:EmbeddedSolrServer使用有个前提条件,需要在solrconfig.xml配置相对应的RequestHandler,如:/update对应更新操作。

四:solrj的使用

创建好server以后,我们就可以开始solrj操作索引库了!!

首先创建一个server,最好的方式是采用单例模式,不要重复去创建。

SolrServer server = new HttpSolrServer("http://HOST:8983/solr/");

1、添加文档到索引库

//创建一个文档

SolrInputDocument doc1 = new SolrInputDocument();
doc1.addField( "id", "id1", 1.0f );
doc1.addField( "name", "doc1", 1.0f );
doc1.addField( "price", 10 );

//再创建一个文档

SolrInputDocument doc2 = new SolrInputDocument();
doc2.addField( "id", "id2", 1.0f );
 doc2.addField( "name", "doc2", 1.0f );
 doc2.addField( "price", 20 );

//创建一个collection,把以上两个文档添加进去

Collection<SolrInputDocument> docs = new ArrayList<SolrInputDocument>();
docs.add( doc1 );
 docs.add( doc2 );

//把文档添加到server中

server.add( docs );

//提交文档

server.commit();//此处只是提交到索引中,不会出现在搜索结果中;如果想立马搜索,请使用commit(boolean waitFlush, boolean waitSearcher)方法

如果你想添加到server后想快速提交(commit),可以采用如下方式:

UpdateRequest req = new UpdateRequest();
req.setAction( UpdateRequest.ACTION.COMMIT, false, false );
req.add( docs );
UpdateResponse rsp = req.process( server );

2、添加pojo到索引库

除了通过文档的形式提交以外,solrj还可以通过pojo的方式提交。使用注解@Field映射到schema.xml中定义的字段中

创建一个javaBean:

import org.apache.solr.client.solrj.beans.Field;
public class Item {
    @Field
    String id;
    @Field("cat")//自定义字段名
    String[] categories;
    @Field
    List<String> features;

    public void setId(String id) {
        this.id = id;
    }

    public void getId() {
        return this.id;
    }

    //其他get、set方法

}

创建JavaBean的实例:

Item item = new Item();
item.id = "one";
item.categories = new String[] { "aaa", "bbb", "ccc" };

添加到server中:

server.addBean(item);

提交到索引:

server.commit();

还可以同时添加多个javaBean:

List<Item> beans ;
//add Item objects to the list
server.addBeans(beans);

3、删除索引

server.deleteById(String id);
或者
deleteById(List<String> ids);

4、更新索引

solr索引库不同于数据库,没有更新的功能。如果想更新,先通过id删除对应的文档,再天新的文档。

5、查询索引

SolrQuery query = new SolrQuery();
query.setQuery( "*:*" );
query.addSortField( "price", SolrQuery.ORDER.asc );
QueryResponse rsp = server.query( query );

//文档方式读取

SolrDocumentList docs = rsp.getResults();//实际项目中如果业务比较复杂,采用这种方式显得比较灵活

//使用javaBean的方式读取

List<Item> beans = rsp.getBeans(Item.class);

6、高级使用

SolrServer server = getSolrServer();
SolrQuery solrQuery = new SolrQuery()
                      . setQuery("ipod")
                      . setFacet(true)
                      . setFacetMinCount(1)
                      . setFacetLimit(8)
                      . addFacetField("category")
                      . addFacetField("inStock");
QueryResponse rsp = server.query(solrQuery);

7、高亮显示

SolrQuery query = new SolrQuery(); query.setQuery("foo");
query.setHighlight(true).setHighlightSnippets(1);
//set other params as needed
query.setParam("hl.fl", "content");
QueryResponse queryResponse = getSolrServer().query(query);

处理高亮显示结果:

Iterator<SolrDocument> iter = queryResponse.getResults().iterator();
while (iter.hasNext()) {
    SolrDocument resultDoc = iter.next();
    String content = (String) resultDoc.getFieldValue("content");
    String id = (String) resultDoc.getFieldValue("id"); //id is the uniqueKey field
    if (queryResponse.getHighlighting().get(id) != null) {
        List<String> highlightSnippets = queryResponse.getHighlighting().get(id).get("content");
    }
}

本文永久链接: http://www.luoshengsha.com/245.html

时间: 2024-08-02 23:20:12

使用solrj操作solr索引库的相关文章

solrj操作solr索引库(流程)

声明:博主自己记录以免忘记,所以无逻辑无参考价值.小女子就是酱紫任性 ---------首先dao层 访问索引库的类.定义一些通用的数据访问方法. 业务逻辑就是查询索引库. 参数:SolrQuery对象 业务逻辑: 1.根据Query对象进行查询. 2.返回查询结果.List<SearchItem>.查询结果的总记录数. 需要把返回结果封装到pojo中,至少包含两个属性:List<SearchItem>.Long recordCount 再包含一个总页数. @Repositoryp

维护solr索引库

一 2)solrcore    一个solr下可以有多个solrcore,每个solrcore就是一个独立的索引库3)solrconfig.xml    lib:配置solr的扩展包的位置,不指定路径的话就是collection1/lib目录,可以自动加载.如果没有需要手动创建    dataDir:索引文件保存的位置.如果不指定默认是Collection1/data目录.如果没有会自动生成    requestHandler:请求的url及对应的处理器的配置4)添加solrcore    1.

(转)淘淘商城系列——使用solrj来测试索引库

http://blog.csdn.net/yerenyuan_pku/article/details/72892280 我们使用solrj来操作索引库,一般习惯先建一个单元测试类测试下增删改查方法是否好使,这样可以大大减少出错概率,提升开发效率. 我们的taotao-search-service工程还没有添加对solrj的依赖,因此需要先添加对solrj的依赖,在taotao-search-service工程的pom.xml文件当中添加如下依赖(之所以不用写版本号是因为在taotao-paren

将数据库的数据导入solr索引库中

在solr与tomcat整合文章中,我用的索引库是mycore,现在就以这个为例. 首先要准备jar包:solr-dataimporthandler-4.8.1.jar.solr-dataimporthandler-extras-4.8.1.jar和mysql-connector-java-5.0.7-bin.jar这三个包到solr的tomcat的webapps\solr\WEB-INF\lib下 在这个文件夹的conf下配置两个文件,添加一个文件.先配置solrconfig.xml. 在该文

solrj 操作 solr 集群版

一.添加 @Test public void testAddDocument() throws Exception{ //创建一个集群的连接,应该使用 CloudSolrServer,//zkHost:zookeeper 的地址表 String zkHost = "192.168.25.129:2181,192.168.25.129:2182,192.168.25.129:2183"; CloudSolrServer solrServer = new CloudSolrServer(z

Solr索引库l配置文件schema.xm要点翻译

<?xml version="1.0" encoding="UTF-8" ?>   略... <!--   这是Solr的schema文件,应该命名为schema.xml,并且在solr home的conf目录下 (如,默认在./solr/conf/schema.xml).  有关如何根据需要定制化该文件,请参照:  http://wiki.apache.org/solr/SchemaXml  性能须知: 这里包含了很多实际应用不需要的可选项. 为

将Mysq数据导入solr索引库

本文的基础环境都是在centos 64bit,jdk1.7.79 将mysql 的jar 包添加到/home/hadoop/cloudsolr/solr-4.10.4/contrib/dataimporthandler/lib 下 修改对应的solrconfig.xml 文件我的core 是collection1,配置文件example/solr/collection1/conf/solrconfig.xml 在配置文件中添加了: <lib dir="/home/hadoop/clouds

solr4使用solrj操作索引库

solr配套有好多的客户端用于操作索引库,下面我们来讲如何用solrj去操作solr索引库. 一.认识solrj solrj是solr的java客户端,用于访问solr索引库.它提供了添加.删除.查询.优化等功能. 二.下载 百度.google以下solrj下载,你会发现根本就没有,那么我们该到哪儿下载呢?其实,它是集成到solr压缩包里的,解压文件后,有个目录/dist/solrj-lib,里面就存放了solrj所用到的jar,你把这些jar都添加到你的classpath就ok. 如果你是使用

Apache Solr 之 使用SolrJ操作索引库

Solrj是Solr搜索服务器的一个比较基础的客户端工具,可以非常方便地与Solr搜索服务器进行交互.最基本的功能就是管理Solr索引,包括添加.更新.删除和查询等.对于一些比较基础的应用,用Solj基本够用,而且你可以非常容易地通过使用Solrj的API实现与Solr搜索服务器进行交互,实现对Solr的基本管理功能.如果你的应用比较复杂,可以扩展Solrj来满足需要. 使用 SolrJ操作索引库: package com.hcm.solr.test; import java.io.IOExce