sky 发表于 2019-1-25 19:43:10

Elasticsearch大数据搜索引擎.pdf


第1章 使用Elasticsearch 11.1 基本概念 11.2 安装 21.3 搜索集群 51.4 创建索引 61.5 使用Java客户端接口 91.5.1 创建索引 111.5.2 增加、删除与修改数据 141.5.3 分析器 161.5.4 数据导入 171.5.5 通过摄取快速导入数据 171.5.6 索引库结构 171.5.7 查询 181.5.8 区间查询 221.5.9 排序 231.5.10 分布式搜索 231.5.11 过滤器 241.5.12 高亮显示 241.5.13 分页 251.5.14 通过聚合实现分组查询 261.5.15 文本列的聚合 271.5.16 遍历数据 281.5.17 索引文档 291.5.18 Percolate 291.6 RESTClient 301.6.1 使用摄取 311.6.2 代码实现摄取 331.7 使用Jest 331.8 Python客户端 371.9 Scala客户端 401.10 PHP客户端 431.11 SQL支持 441.12 本章小结 48第2章 开发插件 492.1 搜索中文 492.1.1 中文分词原理 492.1.2 中文分词插件原理 512.1.3 开发中文分词插件 532.1.4 中文AnalyzerProvider 552.1.5 字词混合索引 572.2 搜索英文 602.2.1 句子切分 602.2.2 标注词性 622.3 使用测试套件 642.4 本章小结 68第3章 管理搜索集群 693.1 节点类型 693.2 管理集群 693.3 写入权限控制 703.4 使用X-Pack 713.5 快照 723.6 Zen发现机制 733.7 联合搜索 743.8 缓存 743.9 本章小结 75第4章 源码分析 764.1 Lucene源码分析 764.1.1 Ivy管理依赖项 764.1.2 源码结构介绍 764.2 Gradle 774.3 Guice 774.4 Joda-Time 794.5 Transport 804.6 线程池 804.7 模块 804.8 Netty 814.9 分布式 814.10 本章小结 82第5章 搜索相关性 835.1 BM25检索模型 835.1.1 使用BM25检索模型 865.1.2 参数调优 865.2 学习评分 865.2.1 基本原理 875.2.2 准备数据 875.2.3 Elasticsearch学习排名 895.3 本章小结 91第6章 搜索引擎用户界面 926.1 JSP实现搜索界面 926.1.1 用于显示搜索结果的自定义标签 936.1.2 使用Listlib 986.1.3 实现翻页 1006.2 使用Spring实现的搜索界面 1026.2.1 实现REST搜索界面 1026.2.2 REST API中的HTTP PUT 1046.2.3 Spring-data-elasticsearch 1066.2.4 Spring HATEOAS 1126.3 实现搜索接口 1136.3.1 编码识别 1136.3.2 布尔搜索 1166.3.3 搜索结果排序 1166.4 实现相似文档搜索 1176.5 实现AJAX搜索联想词 1196.5.1 估计查询词的文档频率 1196.5.2 搜索联想词总体结构 1196.5.3 服务器端处理 1206.5.4 浏览器端处理 1256.5.5 拼音提示 1276.5.6 部署总结 1276.5.7 Suggester 1286.6 推荐搜索词 1296.6.1 挖掘相关搜索词 1306.6.2 使用多线程计算相关搜索词 1326.7 查询意图理解 1336.7.1 拼音搜索 1336.7.2 无结果处理 1336.8 集成其他功能 1346.8.1 拼写检查 1346.8.2 分类统计 1356.8.3 相关搜索 1416.8.4 再次查找 1446.8.5 搜索日志 1446.9 查询分析 1466.9.1 历史搜索词记录 1466.9.2 日志信息过滤 1476.9.3 信息统计 1486.9.4 挖掘日志信息 1506.9.5 查询词意图分析 1506.10 部署网站 1506.10.1 部署到Web服务器 1516.10.2 防止攻击 1526.11 本章小结 156第7章 OCR文字识别 1577.1 Tesseract 1577.2 使用TensorFlow识别文字 1617.3 OpenCV 1647.3.1 预处理 1667.3.2 文字区域提取 1697.3.3 纠正偏斜 1717.3.4 Linux环境支持 1727.4 JavaCV 1727.5 本章小结 174第8章 问答式搜索 1768.1 生成表示语义的代码 1768.2 信息整合 1818.2.1 实体对齐 1818.2.2 编辑距离 1818.2.3 Jaro-Winkler距离 1878.2.4 比较器 1898.2.5 Cleaner 1898.2.6 运行过程 1908.2.7 遗传算法调整参数 1928.3 自动问答 1938.3.1 问句处理器 1938.3.2 自动发现答案 1988.4 本章小结 199第9章 Elastic系统监控 2019.1 Logstash 2019.1.1 使用Logstash 2019.1.2 插件 2039.1.3 数据库输入插件 2069.2 Filebeat 2079.3 消息过期 2089.4 Kibana 2089.5 Flume 2099.6 Kafka 2109.7 Graylog 2119.8 物联网数据 2159.9 本章小结 216

链接: https://pan.baidu.com/s/1-f37PV9smH1K_s6kE2Xl6Q 提取码:

beson2000 发表于 2019-1-25 20:21:05

谢谢分享

lisimba 发表于 2019-1-26 11:05:41

感谢分享,学习

beson2000 发表于 2019-1-29 20:21:56

谢谢分享

xiaozeze 发表于 2019-1-29 21:20:48

谢谢楼主分享啊
页: [1]
查看完整版本: Elasticsearch大数据搜索引擎.pdf