注册 | 登录读书好,好读书,读好书!
读书网-DuShu.com
当前位置: 首页出版图书科学技术计算机/网络软件与程序设计Elasticsearch大数据搜索引擎

Elasticsearch大数据搜索引擎

Elasticsearch大数据搜索引擎

定 价:¥49.00

作 者: 罗刚 著
出版社: 电子工业出版社
丛编项: 人工智能系列
标 签: 计算机/网络 数据库 数据库理论

购买这本书可以去


ISBN: 9787121332333 出版时间: 2018-01-01 包装: 平装
开本: 16开 页数: 228 字数:  

内容简介

  Elasticsearch搜索集群系统在生产和生活中发挥着越来越重要的作用。本书介绍了Elasticsearch的使用、原理、系统优化与扩展应用。本书用例子说明了Java、Python、Scala和PHP的编程API,其中在Java搜索界面实现上,介绍了使用Spring实现微服务开发。为了扩展Elasticsearch的功能,本书以中文分词和英文文本分析为例介绍了插件开发方法。本书介绍了使用Elasticsearch作为数据管理平台的日志监控与分析方法,介绍了使用OCR从图像中提取文本以及问答式搜索的开发方法。

作者简介

  猎兔搜索技术创始人曾经担任国防大学科研处 技术顾问工信部 舆情开发顾问东南大学 社会导师首都师范大学 金融课程讲师北京石油化工学院 社会导师北大光华管理学院 技术顾问蓝汛公司搜索集群技术咨询顾问新东方 创新研究院 研究员

图书目录

第1章 使用Elasticsearch\t1
1.1 基本概念\t1
1.2 安装\t2
1.3 搜索集群\t5
1.4 创建索引\t6
1.5 使用Java客户端接口\t9
1.5.1 创建索引\t11
1.5.2 增加、删除与修改数据\t14
1.5.3 分析器\t16
1.5.4 数据导入\t17
1.5.5 通过摄取快速导入数据\t17
1.5.6 索引库结构\t17
1.5.7 查询\t18
1.5.8 区间查询\t22
1.5.9 排序\t23
1.5.10 分布式搜索\t23
1.5.11 过滤器\t24
1.5.12 高亮显示\t24
1.5.13 分页\t25
1.5.14 通过聚合实现分组查询\t26
1.5.15 文本列的聚合\t27
1.5.16 遍历数据\t28
1.5.17 索引文档\t29
1.5.18 Percolate\t29
1.6 RESTClient\t30
1.6.1 使用摄取\t31
1.6.2 代码实现摄取\t33
1.7 使用Jest\t33
1.8 Python客户端\t37
1.9 Scala客户端\t40
1.10 PHP客户端\t43
1.11 SQL支持\t44
1.12 本章小结\t48
第2章 开发插件\t49
2.1 搜索中文\t49
2.1.1 中文分词原理\t49
2.1.2 中文分词插件原理\t51
2.1.3 开发中文分词插件\t53
2.1.4 中文AnalyzerProvider\t55
2.1.5 字词混合索引\t57
2.2 搜索英文\t60
2.2.1 句子切分\t60
2.2.2 标注词性\t62
2.3 使用测试套件\t64
2.4 本章小结\t68
第3章 管理搜索集群\t69
3.1 节点类型\t69
3.2 管理集群\t69
3.3 写入权限控制\t70
3.4 使用X-Pack\t71
3.5 快照\t72
3.6 Zen发现机制\t73
3.7 联合搜索\t74
3.8 缓存\t74
3.9 本章小结\t75
第4章 源码分析\t76
4.1 Lucene源码分析\t76
4.1.1 Ivy管理依赖项\t76
4.1.2 源码结构介绍\t76
4.2 Gradle\t77
4.3 Guice\t77
4.4 Joda-Time\t79
4.5 Transport\t80
4.6 线程池\t80
4.7 模块\t80
4.8 Netty\t81
4.9 分布式\t81
4.10 本章小结\t82
第5章 搜索相关性\t83
5.1 BM25检索模型\t83
5.1.1 使用BM25检索模型\t86
5.1.2 参数调优\t86
5.2 学习评分\t86
5.2.1 基本原理\t87
5.2.2 准备数据\t87
5.2.3 Elasticsearch学习排名\t89
5.3 本章小结\t91
第6章 搜索引擎用户界面\t92
6.1 JSP实现搜索界面\t92
6.1.1 用于显示搜索结果的自定义标签\t93
6.1.2 使用Listlib\t98
6.1.3 实现翻页\t100
6.2 使用Spring实现的搜索界面\t102
6.2.1 实现REST搜索界面\t102
6.2.2 REST API中的HTTP PUT\t104
6.2.3 Spring-data-elasticsearch\t106
6.2.4 Spring HATEOAS\t112
6.3 实现搜索接口\t113
6.3.1 编码识别\t113
6.3.2 布尔搜索\t116
6.3.3 搜索结果排序\t116
6.4 实现相似文档搜索\t117
6.5 实现AJAX搜索联想词\t119
6.5.1 估计查询词的文档频率\t119
6.5.2 搜索联想词总体结构\t119
6.5.3 服务器端处理\t120
6.5.4 浏览器端处理\t125
6.5.5 拼音提示\t127
6.5.6 部署总结\t127
6.5.7 Suggester\t128
6.6 推荐搜索词\t129
6.6.1 挖掘相关搜索词\t130
6.6.2 使用多线程计算相关搜索词\t132
6.7 查询意图理解\t133
6.7.1 拼音搜索\t133
6.7.2 无结果处理\t133
6.8 集成其他功能\t134
6.8.1 拼写检查\t134
6.8.2 分类统计\t135
6.8.3 相关搜索\t141
6.8.4 再次查找\t144
6.8.5 搜索日志\t144
6.9 查询分析\t146
6.9.1 历史搜索词记录\t146
6.9.2 日志信息过滤\t147
6.9.3 信息统计\t148
6.9.4 挖掘日志信息\t150
6.9.5 查询词意图分析\t150
6.10 部署网站\t150
6.10.1 部署到Web服务器\t151
6.10.2 防止攻击\t152
6.11 本章小结\t156
第7章 OCR文字识别\t157
7.1 Tesseract\t157
7.2 使用TensorFlow识别文字\t161
7.3 OpenCV\t164
7.3.1 预处理\t166
7.3.2 文字区域提取\t169
7.3.3 纠正偏斜\t171
7.3.4 Linux环境支持\t172
7.4 JavaCV\t172
7.5 本章小结\t174
第8章 问答式搜索\t176
8.1 生成表示语义的代码\t176
8.2 信息整合\t181
8.2.1 实体对齐\t181
8.2.2 编辑距离\t181
8.2.3 Jaro-Winkler距离\t187
8.2.4 比较器\t189
8.2.5 Cleaner\t189
8.2.6 运行过程\t190
8.2.7 遗传算法调整参数\t192
8.3 自动问答\t193
8.3.1 问句处理器\t193
8.3.2 自动发现答案\t198
8.4 本章小结\t199
第9章 Elastic系统监控\t201
9.1 Logstash\t201
9.1.1 使用Logstash\t201
9.1.2 插件\t203
9.1.3 数据库输入插件\t206
9.2 Filebeat\t207
9.3 消息过期\t208
9.4 Kibana\t208
9.5 Flume\t209
9.6 Kafka\t210
9.7 Graylog\t211
9.8 物联网数据\t215
9.9 本章小结\t216

本目录推荐