首页
学习
活动
专区
工具
TVP
发布
社区首页 >专栏 >PRESTO-分布式大数据SQL查询引擎

PRESTO-分布式大数据SQL查询引擎

作者头像
Albert陈凯
发布2018-04-04 15:25:13
1.6K0
发布2018-04-04 15:25:13
举报
文章被收录于专栏:Albert陈凯Albert陈凯

http://prestodb-china.com/

PRESTO是什么?

Presto是一个开源的分布式SQL查询引擎,适用于交互式分析查询,数据量支持GB到PB字节。

Presto的设计和编写完全是为了解决像Facebook这样规模的商业数据仓库的交互式分析和处理速度的问题。

它可以做什么?

Presto支持在线数据查询,包括Hive, Cassandra, 关系数据库以及专有数据存储。 一条Presto查询可以将多个数据源的数据进行合并,可以跨越整个组织进行分析。

Presto以分析师的需求作为目标,他们期望响应时间小于1秒到几分钟。 Presto终结了数据分析的两难选择,要么使用速度快的昂贵的商业方案,要么使用消耗大量硬件的慢速的“免费”方案。

谁在使用它?

Facebook使用Presto进行交互式查询,用于多个内部数据存储,包括300PB的数据仓库。 每天有1000多名Facebook员工使用Presto,执行查询次数超过30000次,扫描数据总量超过1PB。

领先的互联网公司包括Airbnb和Dropbox都在使用Presto。

Presto令人吃惊。 首席工程师Andy Kramolisch刚在生产环境使用了几天。 在大多数情况下它比Hive快几个数量级。 与Redshift不同,它直接从HDFS读取数据,在使用前不需要大量的ETL操作,就可以工作。

Christopher Gutierrez, 在线分析经理, Airbnb 我们对Presto感到非常兴奋。 我们打算用它快速获取用户使用Dropbox的不同方式,以及诊断他们遇到的问题。 在我们目前的测试中,它应用于某些最重要的特别用例,它表现稳定并且非常快。

Fred Wulff, 软件工程师, Dropbox

本文参与 腾讯云自媒体分享计划,分享自作者个人站点/博客。
原始发表:2017.06.26 ,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 作者个人站点/博客 前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体分享计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
相关产品与服务
大数据
全栈大数据产品,面向海量数据场景,帮助您 “智理无数,心中有数”!
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档