es核心知识篇学习之Elasticsearch 05

1、document数据格式

2、电商网站商品管理案例:背景介绍

3、简单的集群管理

4、商品的CRUD操作(document CRUD操作)

 

1、document数据格式

 

面向文档的搜索分析引擎

 

(1)应用系统的数据结构都是面向对象的,复杂的

(2)对象数据存储到数据库中,只能拆解开来,变为扁平的多张表,每次查询的时候还得还原回对象格式,

     相当麻烦

(3)ES是面向文档的,文档中存储的数据结构,与面向对象的数据结构是一样的,基于这种文档数据结构,

     es可以提供复杂的索引,全文检索,分析聚合等功能

(4)es的document用json数据格式来表达

 

public classEmployee {

 

  private String email;

  private String firstName;

  private String lastName;

  private EmployeeInfo info;//(引用类)

  private Date joinDate;

 

}

 

private classEmployeeInfo {

 

  private String bio; // 性格

  private Integer age;

  private String[] interests; // 兴趣爱好

 

}

 

EmployeeInfoinfo = new EmployeeInfo();

info.setBio("curiousand modest");

info.setAge(30);

info.setInterests(newString[]{"bike", "climb"});

 

Employeeemployee = new Employee();

employee.setEmail("zhangsan@sina.com");

employee.setFirstName("san");

employee.setLastName("zhang");

employee.setInfo(info);

employee.setJoinDate(newDate());

 

employee对象:里面包含了Employee类自己的属性,还有一个EmployeeInfo对象

 

两张表:

employee表,

employee_info表,

将employee对象的数据重新拆开来,变成Employee数据和EmployeeInfo数据

employee表:       email,first_name,last_name,join_date,4个字段

employee_info表:    bio,age,interests,3个字段;

此外还有一个外键字段,比如employee_id,关联着employee表

 

 

{

    "email":      "zhangsan@sina.com",

    "first_name": "san",

    "last_name": "zhang",

    "info": {

        "bio":         "curious and modest",

        "age":         30,

        "interests": ["bike", "climb" ]

    },

    "join_date":"2017/01/01"

}

 

我们就明白了es的document数据格式和数据库的关系型数据格式的区别

基于数据库存储面向对象的数据是比较麻烦的,数据库中存储的是扁平化的这种数据格式,

完全无法反应出原始的面向对象的数据格式

es所谓的面向文档意思就是文档里存储的数据结构跟面向对象的数据结构是完全一样的,

也就是说不管嵌套了多少层级关系的复杂度对象都能变成es中的一个文档,完全不用像关系型数据库

把一个对象拆开来成数据库中多少张表

 

2、电商网站商品管理案例背景介绍

 

有一个电商网站,需要为其基于ES构建一个后台系统,提供以下功能:

 

(1)对商品信息进行CRUD(增删改查)操作

(2)执行简单的结构化查询

(3)可以执行简单的全文检索,以及复杂的phrase(短语)检索

(4)对于全文检索的结果,可以进行高亮显示

(5)对数据进行简单的聚合分析

 

3、简单的集群管理

 

(1)快速检查集群的健康状况

 

es提供了一套api,叫做catapi,可以查看es中各种各样的数据

 

GET /_cat/health?v   // ?v可以将头取出来

 

启动一个es

epoch      timestamp cluster       status node.total node.data shards prirelo init unassign pending_tasks max_task_wait_time active_shards_percent

148800674115:12:21  elasticsearch yellow          1         1     1   1    0   0        1             0                  -                 50.0%

 

启动两个es

epoch      timestamp cluster       status node.total node.data shards prirelo init unassign pending_tasks max_task_wait_time active_shards_percent

148800711315:18:33  elasticsearch green           2         2     2   1    0   0        0             0                  -                100.0%

 

关闭一个es

epoch      timestamp cluster       status node.total node.data shards prirelo init unassign pending_tasks max_task_wait_time active_shards_percent

148800721615:20:16  elasticsearch yellow          1         1     1   1    0   0        1             0                  -                 50.0%

 

如何快速了解集群的健康状况?greenyellowred

 

green:每个索引的primaryshard和replica shard都是active状态的

yellow:每个索引的primaryshard都是active状态的,但是部分replica shard不是active状态,处于不可用的状态

red:不是所有索引的primaryshard都是active状态的,部分索引有数据丢失了

 

为什么现在会处于一个yellow状态?

我们现在就一个笔记本电脑,就启动了一个es进程,相当于就只有一个node。现在es中有一个index,就是kibana自己内置建立的index。由于默认的配置是给每个index分配5个primary shard和5个replicashard,而且primary shard和replica shard不能在同一台机器上(为了容错)。现在kibana自己建立的index是1个primaryshard和1个replica shard。当前就一个node,所以只有1个primaryshard被分配了和启动了,但是一个replica shard没有第二台机器去启动。

 

做一个小实验:此时只要启动第二个es进程,就会在es集群中有2个node,然后那1个replica shard就会自动分配过去,然后clusterstatus就会变成green状态。

如何查看集群中有哪些索引

 

GET /_cat/indices?v

 

 

 

health statusindex   uuid                   pri rep docs.countdocs.deleted store.size pri.store.size

yellowopen   .kibanarUm9n9wMRQCCrRDEhqneBg   1   1         1            0      3.1kb          3.1kb

 

(3)简单的索引操作

 

创建索引:PUT /test_index?pretty

{

  "acknowledged": true,

  "shards_acknowledged": true

}

 

health statusindex      uuid                   pri rep docs.countdocs.deleted store.size pri.store.size

yellowopen   test_indexXmS9DTAtSkSZSwWhhGEKkQ   5   1         0            0       650b           650b

yellowopen   .kibana    rUm9n9wMRQCCrRDEhqneBg   1  1          1            0      3.1kb          3.1kb

 

删除索引:DELETE /test_index?pretty

{

  "acknowledged": true

}

 

health statusindex   uuid                   pri rep docs.countdocs.deleted store.size pri.store.size

yellowopen   .kibanarUm9n9wMRQCCrRDEhqneBg   1   1         1            0      3.1kb          3.1kb

 

----------------------------------------------------------------------------------------------------------------------------

 

4、商品的CRUD操作

 

(1)新增商品:新增文档,建立索引

 

PUT/index/type/id

{

  "json数据"

}

 

PUT/ecommerce/product/1

{

    "name" : "gaolujieyagao",

    "desc" :  "gaoxiao meibai",

    "price" :  30,

    "producer" :      "gaolujie producer",

    "tags": [ "meibai","fangzhu" ]

}

 

{

  "_index": "ecommerce",

  "_type": "product",

  "_id": "1",

  "_version": 1,

  "result": "created",

  "_shards": {

    "total": 2,

    "successful": 1,

    "failed": 0

  },

  "created": true

}

 

PUT/ecommerce/product/2

{

    "name" : "jiajieshiyagao",

    "desc" :  "youxiao fangzhu",

    "price" :  25,

    "producer" :      "jiajieshi producer",

    "tags": [ "fangzhu" ]

}

 

PUT/ecommerce/product/3

{

    "name" : "zhonghuayagao",

    "desc" :  "caoben zhiwu",

    "price" :  40,

    "producer" :      "zhonghua producer",

    "tags": [ "qingxin" ]

}

 

es会自动建立indextype,不需要提前创建,而且es默认会对document每个field都建立倒排索引,让其可以被搜索

 

(2)查询商品:检索文档

 

GET /index/type/id

GET/ecommerce/product/1

 

{

  "_index": "ecommerce",

  "_type": "product",

  "_id": "1",

  "_version": 1,

  "found": true,

  "_source": {

    "name": "gaolujieyagao",

    "desc": "gaoxiaomeibai",

    "price": 30,

    "producer": "gaolujieproducer",

    "tags": [

      "meibai",

      "fangzhu"

    ]

  }

}

 

(3)修改商品:替换文档

 

PUT/ecommerce/product/1

{

    "name" : "jiaqiangbangaolujie yagao",

    "desc" :  "gaoxiao meibai",

    "price" :  30,

    "producer" :      "gaolujie producer",

    "tags": [ "meibai","fangzhu" ]

}

 

consle显示:

之前的:

{

  "_index": "ecommerce",

  "_type": "product",

  "_id": "1",

  "_version": 1,

  "result": "created",

  "_shards": {

    "total": 2,

    "successful": 1,

    "failed": 0

  },

  "created": true

}

现在的:

{

  "_index": "ecommerce",

  "_type": "product",

  "_id": "1",

  "_version": 2,

  "result": "updated",

  "_shards": {

    "total": 2,

    "successful": 1,

    "failed": 0

  },

  "created": false

}

 

假如这样修改:

PUT/ecommerce/product/1

{

    "name" : "jiaqiangbangaolujie yagao"

}

原先的表中的内容就会被覆盖掉

替换方式有一个不好,即使必须带上所有的field,才能去进行信息的修改

 

(4)修改商品:更新文档

 

POST/ecommerce/product/1/_update

{

  "doc": {

    "name": "jiaqiangbangaolujie yagao"

  }

}

 

{

  "_index": "ecommerce",

  "_type": "product",

  "_id": "1",

  "_version": 8,

  "result": "updated",

  "_shards": {

    "total": 2,

    "successful": 1,

    "failed": 0

  }

}

 

(5)删除商品:删除文档

 

DELETE/ecommerce/product/1

 

{

  "found": true,

  "_index": "ecommerce",

  "_type": "product",

  "_id": "1",

  "_version": 9,

  "result": "deleted",

  "_shards": {

    "total": 2,

    "successful": 1,

    "failed": 0

  }

}

 

{

  "_index": "ecommerce",

  "_type": "product",

  "_id": "1",

  "found": false

}


  • 1
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值