🚗Es学习·第六站~
🚩Es学习起始站：【微服务】Elasticsearch概述&环境搭建(一)
🚩本文已收录至专栏：微服务探索之旅
👍希望您能有所收获

一.引入

单机的elasticsearch做数据存储，必然面临两个问题：海量数据存储问题、单点故障问题。

海量数据存储问题：单机能存储的数据是有上限的
- 解决：将索引库从逻辑上拆分为N个分片（shard），存储到多个节点
单点故障问题：存储数据的机器宕机或出现了不可逆的损失导致数据丢失
- 解决将分片数据在不同节点备份（replica ）

二.相关概念

解决上述问题就需要对Es进行集群部署。

集群（cluster）：一组拥有共同的 cluster name 的节点。
节点（node) ：集群中的一个 Elasticearch 实例
分片（shard）：索引可以被拆分为不同的部分进行存储，称为分片。在集群环境下，一个索引的不同分片可以拆分到不同的节点中

解决问题：数据量太大，单点存储量有限的问题。

此处，我们把数据分成3片：shard0、shard1、shard2

主分片（Primary shard）：相对于副本分片的定义。
副本分片（Replica shard）每个主分片可以有一个或者多个副本，数据和主分片一样。

数据备份可以保证高可用，但是每个分片备份一份，所需要的节点数量就会翻一倍，成本实在是太高了！

为了在高可用和成本间寻求平衡，我们可以这样做：

首先对数据分片，存储到不同节点
然后对每个分片进行备份，放到对方节点，完成互相备份

这样可以大大减少所需要的服务节点数量，例如，我们以3分片，每个分片备份一份，以此解决单点故障问题：
在这里插入图片描述

现在，每个分片都有1个备份，存储在3个节点：

node0：保存了分片0和1数据
node1：保存了分片0和2数据
node2：保存了分片1和2数据

三.部署ES集群

(1) 创建Es集群

因为docker容器之间相互隔离，如下我们用3个docker容器模拟3个es的节点。不过生产环境推荐大家每台服务节点仅部署一个es的实例。

部署es集群可以直接使用docker-compose来完成，不过要求你的Linux虚拟机至少有4G的内存空间。

首先编写一个docker-compose文件，并上传到虚拟机。文件内容如下：

version: '2.2'
services:
  es01:
    image: docker.elastic.co/elasticsearch/elasticsearch:7.12.1
    container_name: es01  # 容器名称
    environment:
      - node.name=es01  # 节点名称
      - cluster.name=es-docker-cluster  # 集群名称
      - discovery.seed_hosts=es02,es03  # 其他节点ip地址
      - cluster.initial_master_nodes=es01,es02,es03  # 初始化主节点
      - bootstrap.memory_lock=true
      - "ES_JAVA_OPTS=-Xms512m -Xmx512m"
    ulimits:
      memlock:
        soft: -1
        hard: -1
    volumes:
      - data01:/usr/share/elasticsearch/data
    ports:
      - 9200:9200
    networks:
      - elastic
  es02:
    image: elasticsearch:7.12.1
    container_name: es02
    environment:
      - node.name=es02
      - cluster.name=es-docker-cluster
      - discovery.seed_hosts=es01,es03
      - cluster.initial_master_nodes=es01,es02,es03
      - "ES_JAVA_OPTS=-Xms512m -Xmx512m"
    volumes:
      - data02:/usr/share/elasticsearch/data
    ports:
      - 9201:9200
    networks:
      - elastic
  es03:
    image: elasticsearch:7.12.1
    container_name: es03
    environment:
      - node.name=es03
      - cluster.name=es-docker-cluster
      - discovery.seed_hosts=es01,es02
      - cluster.initial_master_nodes=es01,es02,es03
      - "ES_JAVA_OPTS=-Xms512m -Xmx512m"
    volumes:
      - data03:/usr/share/elasticsearch/data
    networks:
      - elastic
    ports:
      - 9202:9200
volumes:
  data01:
    driver: local
  data02:
    driver: local
  data03:
    driver: local

networks:
  elastic:
    driver: bridge

es运行需要修改一些linux系统权限，修改/etc/sysctl.conf文件

vi /etc/sysctl.conf

在文件添加如下配置

vm.max_map_count=262144

执行命令，使修改生效

sysctl -p

运行docker-compose 文件部署集群:

docker-compose up -d

(2) 集群状态监控

kibana可以监控es集群，但是不太方便且新版本需要依赖es的x-pack 功能，配置也比较复杂。

推荐使用cerebro来监控es集群状态，官方网址：https://github.com/lmenezes/cerebro

安装解压好后，进入bin目录，双击其中的cerebro.bat文件即可启动服务。

访问http://localhost:9000 即可进入管理界面：
在这里插入图片描述

输入你的elasticsearch的任意节点的地址和端口，点击connect即可：
在这里插入图片描述

如此可以看到我们部署的三个节点。上面绿色的条，代表集群处于绿色（健康状态）。实心五角表示主节点。

(3) 使用集群Es

(3.1) 利用kibana创建索引库

在DevTools中输入指令：

PUT /guanzhi
{
  "settings": {
    "number_of_shards": 3, // 分片数量
    "number_of_replicas": 1 // 副本数量
  },
  "mappings": {
    "properties": {
      // mapping映射定义 ...
    }
  }
}