[hi@vpsee.com]$ su root -

安装和使用 Elasticsearch

2014年05月16日 | 标签: elasticsearch, linux, python

Elasticsearch 是开源搜索平台的新成员，实时数据分析的神器，发展迅猛，基于 Lucene、RESTful、分布式、面向云计算设计、实时搜索、全文搜索、稳定、高可靠、可扩展、安装＋使用方便，介绍都说的很好听，好不好用拿出来遛一遛。

做了个简单测试，在两台完全一样的虚拟机上，2000万条左右数据，Elasticsearch 插入数据速度比 MongoDB 慢很多（可以忍受），但是搜索/查询速度快10倍以上，这只是单机情况，多机集群情况下 Elasticsearch 表现更好一些。以下安装步骤在 Ubuntu Server 14.04 LTS 上完成。

安装 Elasticsearch

升级系统后安装 Oracle Java 7，既然 Elasticsearch 官方推荐使用 Oracle JDK 7 就不要尝试 JDK 8 和 OpenJDK 了：

$ sudo apt-get update
$ sudo apt-get upgrade

$ sudo apt-get install software-properties-common
$ sudo add-apt-repository ppa:webupd8team/java
$ sudo apt-get update

$ sudo apt-get install oracle-java7-installer

加入 Elasticsearch 官方源后安装 elasticsearch：

$ wget -O - http://packages.elasticsearch.org/GPG-KEY-elasticsearch | sudo apt-key add -
$ sudo echo "deb http://packages.elasticsearch.org/elasticsearch/1.1/debian stable main" >> /etc/apt/sources.list

$ sudo apt-get update
$ sudo apt-get install elasticsearch

加入到系统启动文件并启动 elasticsearch 服务，用 curl 测试一下安装是否成功：

$ sudo update-rc.d elasticsearch defaults 95 1

$ sudo /etc/init.d/elasticsearch start

$ curl -X GET 'http://localhost:9200'
{
  "status" : 200,
  "name" : "Fer-de-Lance",
  "version" : {
    "number" : "1.1.1",
    "build_hash" : "f1585f096d3f3985e73456debdc1a0745f512bbc",
    "build_timestamp" : "2014-04-16T14:27:12Z",
    "build_snapshot" : false,
    "lucene_version" : "4.7"
  },
  "tagline" : "You Know, for Search"
}

Elasticsearch 的集群和数据管理界面 Marvel 非常赞，可惜只对开发环境免费，如果这个工具也免费就无敌了，安装很简单，完成后重启服务访问 http://192.168.2.172:9200/_plugin/marvel/ 就可以看到界面：

$ sudo /usr/share/elasticsearch/bin/plugin -i elasticsearch/marvel/latest

$ sudo /etc/init.d/elasticsearch restart
 * Stopping Elasticsearch Server                                           [ OK ]
 * Starting Elasticsearch Server                                           [ OK ]

Elasticsearch Marvel

安装 Python 客户端驱动

和 MongoDB 一样，我们一般用程序和 Elasticsearch 交互，Elasticsearch 也支持多种语言的客户端驱动，这里仅安装 Python 驱动，其他语言可以参考官方文档。

$ sudo apt-get install python-pip
$ sudo pip install elasticsearch

写个简单程序把 gene_info.txt 的数据导入到 Elasticsearch：

#!/usr/bin/python
# -*- coding: UTF-8 -*-

import os, os.path, sys, re
import csv, time, string
from datetime import datetime
from elasticsearch import Elasticsearch

def import_to_db():
    data = csv.reader(open('gene_info.txt', 'rb'), delimiter='\t')
    data.next()

    es = Elasticsearch()
    for row in data:
        doc = {
            'tax_id': row[0],
            'GeneID': row[1],
            'Symbol': row[2],
            'LocusTag': row[3],
            'Synonyms': row[4],
            'dbXrefs': row[5],
            'chromosome': row[6],
            'map_location': row[7],
            'description': row[8],
            'type_of_gene': row[9],
            'Symbol_from_nomenclature_authority': row[10],
            'Full_name_from_nomenclature_authority': row[11],
            'Nomenclature_status': row[12],
            'Other_designations': row[13],
            'Modification_date': row[14]
        }
        res = es.index(index="gene", doc_type='gene_info', body=doc)

def main():
    import_to_db()

if __name__ == "__main__":
    main()

Kibana 是一个功能强大的数据显示客户端，通过插件方式和 Elasticsearch 集成在一起，安装很容易，下载解压就可以了，然后重启 Elasticsearch 服务访问 http://192.168.2.172:9200/_plugin/kibana/ 就能看到界面：

$ wget https://download.elasticsearch.org/kibana/kibana/kibana-3.0.1.tar.gz
$ tar zxvf kibana-3.0.1.tar.gz
$ sudo mv kibana-3.0.1 /usr/share/elasticsearch/plugins/_site
$ sudo /etc/init.d/elasticsearch restart

Elasticsearch Kibana

分类：Linux | BSD | Solaris | 评论(12)

随机

Docker for Mac 公测版试用 | 隔叶黄莺 Yanbin Blog - 软件编程实践: […] 1. Docker for Mac 初体验 2. Mac OS X 上基于 FreeBSD/bhyve 的虚拟技术 xhyve 3. Inside Docker for OS X […]
Michael Li: 2023年了，我是刚入门的新手，没想到十年前的帖子竟然还有这么多人在回复没想到mac vs win的话题这么久以前就有我已经买了新款mac哈哈哈哈首页上作者的帖子似乎停在了2015年，是不再更新了吗？
lqs: 看到进度条，震惊了，往下翻，果然评论更新到最近。。。话说这种评论系统是啥啊？怎么防止垃圾信息？
yu: 我还以为是个老贴，没想到还有这么新的消息！！！macmini m1到手后感觉不太习惯，目前就感觉那个终端确实比较好用，其他的感觉好像没太大区别，还有就是因为工作是做前端三维方面的开发，这块感觉还是有高端显卡的游戏本或台式机性价比比较高，macmini m1如果渲染一些bim模型或者大场景会卡顿，目前macmini被我当服务器在用，跑一些简单的服务，感觉没发挥应有价值，各位大佬有什么建议或者教程，欢迎指导一下我
mailer3721: 2023年了，这个帖子还在持续增长看着自己2012年、2014年的回帖很感慨这几年什么样的系统都用过，但目前要换电脑时还是会纠结买ThinkPad好还是买MacBook pro，可谓此恨绵绵无绝期，细细分析，感觉其实每个系统都有让你别扭的不足，关键还是看自己重度使用的场景，投奔什么阵营。
firfor: 我把这些整理到一个mac初始化脚本了，不过主要是java后端开发人员使用。如果有需要的直接拿走吧。代码： https://github.com/jianhong-li/macbookpro-env-init
庆丰大帝: 我已经连任三届了你们还在争吵哪个好 ^ ^
Lorre: dwm我的超人！
lycnsc: 希望继续，不要停话说2022年的 Macbook Air M2 24GB memory 的很爽
russel: 回viktor。早期的帖子反而大家都很和气，越临近现在反而更容易争吵，viktor的评论内容不是反问就是拿自己来比较，踩别人一头，完全看不出来有任何指导性的建议，更像是居高临下的教训，即使你有很高的水平，就这份自大也会让人恶心。

友链

LinuxTOY

安装和使用 Elasticsearch

安装 Elasticsearch

安装 Python 客户端驱动

分类

随机

评论

友链

关于