当前位置 : IT培训网 > Java开发 > Java培训 > Java程序员常用的大数据工具 你掌握了几种

Java程序员常用的大数据工具 你掌握了几种

时间:2017-07-17 17:52:55  来源:Java培训网  作者:IT培训网  已有:名学员访问该课程
Java程序员因java语言的热门变的身价倍增,大数据已成为IT界超前开发语言,作为java程序员必备的大数据工具有哪几种?下面一起去看看熟悉熟悉。

Java程序员因java语言的热门变的身价倍增,大数据已成为IT界超前开发语言,作为java程序员必备的大数据工具有哪几种?下面一起去看看熟悉熟悉。

java大数据是数据集的一个广义的术语,并且该数据集是如此庞大和复杂,以致于传统的数据处理应用程序无法胜任。

在许多情况下,使用SQL数据库用于存储/检索数据就足够了。但在另一些情况下,要么SQL数据库规模不够,要么还有更好的工具。

存储/处理数据用的不同的非SQL工具——NoSQL数据库,内存缓存,全文搜索引擎,实时流,图形数据库,等等。

1、MongoDB—— 一种流行的,跨平台的面向文档的数据库。

2、Elasticsearch——专为云而构建的分布式REST风格搜索引擎。

3、Cassandra——一个开源的分布式数据库管理系统,最初由Facebook开发,被设计用来处理横跨多个商用服务器的大量数据,提供了无单点故障的高度可用性。

4、Redis—— 一个开源的(BSD许可),内存数据结构存储,作为数据库、缓存和消息代理使用。

5、Hazelcast——基于Java的开源内存数据网格。

6、EHCache——一种被广泛使用的开源Java分布式缓存,用于通用缓存、Java EE和轻量级容器。Ehcache相关介绍

7、Hadoop——用Java编写的一个开源软件框架,用于分布式存储和对在计算机集群上的超大型数据集的分布式处理。

8、Solr——一个开源的企业搜索平台,用Java编写的,来自于Apache Lucene项目。

9、Spark——Apache Software Foundation中最活跃的项目,一个开源的集群计算框架。

10、Memcached—— 一个通用的分布式内存缓存系统。

11、Apache Hive——提供了Hadoop之上类似于SQL的层。

12、Apache Kafka—— 一个高通量、分布式的发布-订阅式消息系统,最初开发在LinkedIn上。Windows上脱离Cygwin运行Apache Kafka

13、Akka—— 一个工具包和运行时,用于在JVM上构建高度并行的、分布式的、有弹性的消息驱动的应用程序。

14、HBase—— 一个开源的,非关系型的,分布式数据库,在谷歌的BigTable后建模,用Java编写,并运行在HDFS上。

15、Neo4j——用Java实现的开源图形数据库。

16、CouchBase——一个开源的、面向文档的分布式NoSQL数据库,特别为了交互式应用而优化。

17、Apache Storm——开源的分布式实时计算系统。

18、CouchDB——使用JSON来存储数据的面向文档的开源NoSQL数据库。

19、Oracle Coherence—— 一个内存的数据网格解决方案,通过提供快速访问常用数据的渠道,使得企业可预测地扩展关键任务应用程序。

20、Titan—— 一个可扩展的图形数据库,优化的目的在于存储和查询包含数千亿顶点和边的图形,分布在多机集群。

21、Amazon DynamoDB——一个快速、灵活、完全管理的NoSQL数据库服务,用于在任何规模需要一致的、个位数毫秒延迟的所有应用程序。

22、Datomic—— 一个用Clojure写的完全事务式的,支持云的,分布式数据库。

23、Amazon Kinesis—— 用于在AWS上的流数据的实时平台。

顶一下
(0)
0%
踩一下
(0)
0%

IT培训0元试听 每期开班座位有限.0元试听抢座开始! IT培训0元试听

  • 姓名 : *
  • 电话 : *
  • QQ : *
  • 留言 :
  • 验证码 : 看不清?点击更换请输入正确的验证码

在线咨询在线咨询

温馨提示 : 请保持手机畅通,咨询老师为您
提供专属一对一报名服务。

------分隔线----------------------------
------分隔线----------------------------

推荐内容