你好世界helloworld_基于Spring Boot的问答系统:elasticsearch 7.2的hello world入门

7908483810e2f45a7a4251bdf35df242.png

好久没有写代码了,最近想做一个基于spring boot + vue + elasticsearch + NLP(语义相关性)的小系统练练手,系统后面可以成为一个聊天机器人,客服系统的原型等等。

所以今天就带来第一篇文章:elasticsearch的hello world入门

一、安装es

目标:在本地安装一个单节点es玩

1.下载es

目前官网最新的下载地址是:https://artifacts.elastic.co/downloads/elasticsearch/elasticsearch-7.2.0-linux-x86_64.tar.gz
下载之后,解压到一个目录,比如你的开发目录:your_path/elasticsearch

2.更改配置文件

a. 配置文件路径:config/elasticsearch.yml
b. 把下面的项改为成自己的值

# Use a descriptive name for your cluster:
# 集群名
cluster.name: my-ces
#
# ------------------------------------ Node ------------------------------------
#
# Use a descriptive name for the node:
# 节点名
node.name: ces-node-1
# Path to directory where to store the data (separate multiple locations by comma):
# es存储数据的地方
path.data: ~/es/data
#
# Path to log files:
# es的运行log
path.logs: ~/es/logs
# Set the bind address to a specific IP (IPv4 or IPv6):
# 绑定地址为本地
network.host: _local_
#
# Set a custom port for HTTP:
# 监听端口
http.port: 9200

3. 运行测试

a. 运行bin/elasticsearch,
b. 打开浏览器输入:localhost:9200,如果显示以下内容,则成功。

{
  

4. 安装ik插件并测试

ik是什么

ik是一个分词插件,要使用es来检索中文数据,需要安装本插件。

安装

按照https://github.com/medcl/elasticsearch-analysis-ik上面但指引安装并测试就可以了

二、创建索引

首先索引类似一个mysql数据库的table,你要往es里面存数据,当然就需要es里面先建立一个索引。

网上很多教程就是基于原生的http接口教大家如何创建索引,如果对于es或者http不熟悉的朋友,经常搞得一头雾水,今天我教大家使用es的python包来做。

安装python的elasticsearch包

pip 

定义mapping.json

这个的作用就是,定义index长什么样子,哪些字段需要被检索,哪些字段不检索,假如现在有一个一问一答的数据:

question: 世界上最高的山峰是什么
answer:当然是珠峰了

我们想使用es来检索,做成一个问答机器人,那么我们定义如下的index结构:

{
    

并保存为:es_index_mapping.json

创建索引

使用python版本的es很简单就实现了,直接上代码:

from 

三、批量导入数据

创建好了index,那么我们就要往里面导入数据,python的es包提供批量导入的功能,只需要几行代码就可以实现:

假如你有一个文件qa.processed.txt,是这样的格式:
queryt['answer1','answer2'],比如
你开心吗t["很开心"]
class 

执行完上述的操作之后,数据就哗哗的导入到es中了。

搜索

导入数据之后,我们就要去搜索数据了,同样的使用es包里面的search函数就搞定了。比如现在你想搜索:你好

那么代码如何写呢?

class 

然后你打印一下返回的结果,就知道数据返回是什么样了。

附:几个常见状态操作

  1. 索引状态
  • curl -X GET "localhost:9200/_cat/indices?v&pretty"
  1. 集群状态
  • curl -X GET "localhost:9200/_cat/health?v&pretty"
  1. 索引mapping & setting
  • curl -X GET "localhost:9200/customer?pretty"
  • customer是index
  1. 通过id查询一个index下的文档数据
  • curl -X GET "localhost:9200/customer/_doc/1?pretty"
  • customer是index

今天是开篇,尽量写得非常简单,如果有什么不懂,可以给我后台留言,我会一一回复你的,也可以添加我的微信(可以看以前的文章,如何添加哦)

00d52b930cf8243ef7a3c76f17d5fb62.png

Laydies and 兄弟们,看完了,收藏了也点个赞激励一下我,请收下我的美图以表感谢。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值