zoukankan      html  css  js  c++  java
  • Solr的创建者介绍Apache Solr : 基于Lucene的可扩展集群搜索服务器

    Apache Solr项目,是一款基于Apache Lucene的开源企业搜索服务器,最近发布了1.3版。InfoQ采访了Solr的创建者Yonik Seeley,了解了新版本的更多信息和Solr提供给最终用户的功能。

    Seeley首先描述了目标用户:“需要搜索框、分面浏览(导航)或者两者结合的任何人”,Solr的关键特性包括:

    • 基于标准的开放接口——Solr搜索服务器支持通过XML、JSON和HTTP查询和获取结果。
    • 易管理——Solr可以通过HTML页面管理,服务器统计数据以JMX输出,Solr配置通过XML完成。
    • 分面浏览——搜索结果自动分类。
    • 突出显示命中词——匹配的字符自动在搜索结果中高亮显示。
    • 可伸缩性——快速增量更新和快照分发/复制到其他服务器。
    • 灵活的插件体系——新功能能够以插件的形式方便的添加到Solr服务器上。

    Seeley同时谈到了该版本中的主要新功能:

    • 分布式搜索——索引现在可以透明的分割成多个部分,单个Solr服务器基于各个配置和模式支持多索引,无须停止Solr服务器就可以改动主要的配置。
    • 扩展了查询功能——包含了一个新的Java客户端(SolrJ)和若干新功能,例如直接配置对于特定查询哪些文档首先命中、近似命中、搜索过期、记录分面时间和拼写检查
    • 增强了数据导入工具——数据库和其他结构化数据源现在都可以导入、映射和转化。
    • 更多可定制扩展点——存在一个新的更新处理器链,允许在查询时修改和重定向文档;一个搜索组件链修改和添加查询结果、用户查询分析器和插件式功能。
    • 性能增强——显著提高了索引速度,二进制响应格式和快速查询删除功能。

    详细的更新日志可以这里获得。

    Seeley谈到了更多Solr在伸缩性、功能和实用性方面的细节:

    Solr已经部署过数以百万计容量的文档,如果借助分布式搜索,Solr应该能够处理数十亿的文档集合。

    Solr基于Lucene,具有优秀的全文相关性,可以很方便的提供词组接近性增强、近期文档增强、编辑增强和基于数字值的专有函数的定制评分机制。

    AOL正在使用Solr增强它的频道功能:音乐、橄榄球运动、食谱、参考中心、房地产和汽车都使用这项技术。Solr的搜索功能也应用于Netflix、 Zappos、Gamespot、和Internet Archive。还有很多大客户我目前还不能透漏。

    关于Solr的未来计划,Seeley提到了更多的可扩展性、对大集群更方便的配置和管理、基于区域和实时的搜索、重构以使用Spring配置插件。Seeley同时提供了一个邮件列表,在那里他详细讨论了Solr未来、特别是2.0版的计划。

    查看英文原文:Apache Solr: Extensible, Clustered Search Server Built on Lucene

    译者 崔康 是InfoQ中文站的翻译主编,从事企业级Web应用的相关工作,关注性能优化、Web技术、浏览器等领域。

  • 相关阅读:
    AutoCAD DxfCode组码值说明
    AutoCAD DxfCode组码值类型
    C#类、静态类、静态变量,初始化执行顺序
    AutoCAD.NET二次开发:扩展数据之XData
    AutoCAD.NET二次开发:创建自定义菜单的两种方法比较
    AutoCAD.NET二次开发:创建自定义菜单(COM)
    AutoCAD.NET二次开发:创建自定义菜单(AcCui)
    发布ASP.NET网站时的设置
    Centos7安装Docker
    Ant Design Pro实现导出Excel
  • 原文地址:https://www.cnblogs.com/ibook360/p/2267370.html
Copyright © 2011-2022 走看看