大规模并行查询引擎 BlinkDB__BlinkDB_查询引_查询_应时间_Inc_

当前位置: 软件>java软件

大规模并行查询引擎 BlinkDB

来源: 发布时间：2015-02-22

本文导语: BlinkDB 是一个用于在海量数据上运行交互式 SQL 查询的大规模并行查询引擎。它允许用户通过权衡数据精度来提升查询响应时间，其数据的精度被控制在允许的误差范围内。为了达到这个目标，BlinkDB 使用两个核心思想: 一个自...

BlinkDB 是一个用于在海量数据上运行交互式 SQL 查询的大规模并行查询引擎。它允许用户通过权衡数据精度来提升查询响应时间，其数据的精度被控制在允许的误差范围内。

为了达到这个目标，BlinkDB 使用两个核心思想:

我们已经使用了 TPC-H 基准测试来评估 BlinkDB 的性能，实际分析工作负载来自 Conviva Inc. 和在 Facebook Inc 的部署。

在 VLDB 2012 中，BlinkDB 演示了在 Amazon EC2 集群部署了 100 个节点，大约 17TB 的数据中查询不到 2 秒钟，比 Hive 快 200 倍，错误率在 2-10%。

大规模并行查询引擎 BlinkDB[图片]

本站(WWW.)旨在分享和传播互联网科技相关的资讯和技术，将尽最大努力为读者提供更好的信息聚合和浏览方式。
本站(WWW.)站内文章除注明原创外，均为转载、整理或搜集自网络。欢迎任何形式的转载，转载请注明出处。