zoukankan      html  css  js  c++  java
  • 1001种玩法 | 数据存储 (3)

    InfluxDB:开源分布式数据库

    InfluxDB 是一个开源,分布式,时间序列,事件,可度量和无外部依赖的数据库。新智云

    它有三大特性:

    1. Time Series (时间序列):你可以使用与时间有关的相关函数(如最大,最小,求和等)

    2. Metrics(度量):你可以实时对大量数据进行计算

    3. Eevents(事件):它支持任意的事件数据

    HTTP API:

    influxdb.writePoints("user_events", [{email: "paul@influxdb.org", state: "NY", type: "click"}]);

    查询语句:

    series = influxdb.query(

     "select percentile(value, 90) from response_times " +

     "group by time(1h) where time > now() - 2d;");

    series = influxdb.query(

     "select count(email) from events " +

     "group by time(10m) " +

     "where email =~ /.*gmail.com/ and time > now() - 1d");

    内置浏览器:你可以通过自带的浏览工具查看你的数据。

    适用于个性化分析:它适合于各种个性化分析。

    Apache Cassandra:开源分布式Key-Value存储系统

    Apache Cassandra是一套开源分布式Key-Value存储系统。它最初由Facebook开发,用于储存特别大的数据。Facebook目前在使用此系统。

    主要特性:

    分布式

    基于column的结构化

    高伸展性

    Cassandra的主要特点就是它不是一个数据库,而是由一堆数据库节点共同构成的一个分布式网络服务,对Cassandra 的一个写操作,会被复制到其他节点上去,对Cassandra的读操作,也会被路由到某个节点上面去读取。对于一个Cassandra群集来说,扩展性能 是比较简单的事情,只管在群集里面添加节点就可以了。

    Cassandra是一个混合型的非关系的数据库,类似于Google的BigTable。其主要功能比 Dynomite(分布式的Key-Value存 储系统)更丰富,但支持度却不如文档存储MongoDB(介于关系数据库和非关系数据库之间的开源产品,是非关系数据库当中功能最丰富,最像关系数据库 的。支持的数据结构非常松散,是类似json的bjson格式,因此可以存储比较复杂的数据类型。)Cassandra最初由Facebook开发,后转变成了开源项目。它是一个网络社交云计算方面理想的数据库。以Amazon专有的完全分布式的Dynamo为基础,结合了Google BigTable基于列族(Column Family)的数据模型。P2P去中心化的存储。很多方面都可以称之为Dynamo 2.0。

    和其他数据库比较,有几个突出特点:

    模式灵活 :使用Cassandra,像文档存储,你不必提前解决记录中的字段。你可以在系统运行时随意的添加或移除字段。这是一个惊人的效率提升,特别是在大型部 署上。

    真正的可扩展性 :Cassandra是纯粹意义上的水平扩展。为给集群添加更多容量,可以指向另一台电脑。你不必重启任何进程,改变应用查询,或手动迁移任何数据。

    多数据中心识别 :你可以调整你的节点布局来避免某一个数据中心起火,一个备用的数据中心将至少有每条记录的完全复制。

    一些使Cassandra提高竞争力的其他功能:

    范围查询 :如果你不喜欢全部的键值查询,则可以设置键的范围来查询。

    列表数据结构 :在混合模式可以将超级列添加到5维。对于每个用户的索引,这是非常方便的。

    分布式写操作 :有可以在任何地方任何时间集中读或写任何数据。并且不会有任何单点失败。

    MongoDB

    MongoDB是一个介于关系数据库和非关系数据库之间的产品,是非关系数据库当中功能最丰富,最像关系数据库的。他支持的数据结构非常松散,是类似json的bjson格式,因此可以存储比较复杂的数据类型。Mongo最大的特点是他支持的查询语言非常强大,其语法有点类似于面向对象的查询语言,几乎可以实现类似关系数据库单表查询的绝大部分功能,而且还支持对数据建立索引。

    它的特点是高性能、易部署、易使用,存储数据非常方便。主要功能特性有:

    面向集合存储,易存储对象类型的数据。

    模式自由。

    支持动态查询。

    支持完全索引,包含内部对象。

    支持查询。

    支持复制和故障恢复。

    使用高效的二进制数据存储,包括大型对象(如视频等)。

    自动处理碎片,以支持云计算层次的扩展性

    支持RUBY,PYTHON,JAVA,C++,PHP等多种语言。

    文件存储格式为BSON(一种JSON的扩展)

    可通过网络访问

    所谓“面向集合”(Collenction-Orented),意思是数据被分组存储在数据集中,被称为一个集合(Collenction)。每个 集合在数据库中都有一个唯一的标识名,并且可以包含无限数目的文档。集合的概念类似关系型数据库(RDBMS)里的表(table),不同的是它不需要定 义任何模式(schema)。

    模式自由(schema-free),意味着对于存储在mongodb数据库中的文件,我们不需要知道它的任何结构定义。如果需要的话,你完全可以把不同结构的文件存储在同一个数据库里。

    存储在集合中的文档,被存储为键-值对的形式。键用于唯一标识一个文档,为字符串类型,而值则可以是各中复杂的文件类型。我们称这种存储形式为BSON(Binary Serialized dOcument Format)。

    MongoDB服务端可运行在Linux、Windows或OS X平台,支持32位和64位应用,默认端口为27017。推荐运行在64位平台,因为MongoDB

    在32位模式运行时支持的最大文件尺寸为2GB。

    MongoDB把数据存储在文件中(默认路径为:/data/db),为提高效率使用内存映射文件进行管理。

  • 相关阅读:
    TCP,IP,HTTP,SOCKET区别和联系
    添加Nginx为系统服务(设置开机启动)
    设计模式大全
    linux 命令行 光标移动技巧等
    Linux中ping命令
    TCP/IP协议 三次握手与四次挥手【转】
    Node 出现 uncaughtException 之后的优雅退出方案
    Google Protocol Buffers简介
    关于绝对路径和相对路径
    node定时任务——node-schedule模块使用说明
  • 原文地址:https://www.cnblogs.com/enncloudcn/p/6909484.html
Copyright © 2011-2022 走看看