严格来说,Hadoop 本身不是数据库,而是一个分布式存储与计算框架。但它可以通过组建来“支持 SQL”。
常见情况如下:
Hadoop 生态中很多组件都支持类 SQL 查询:
| 组件 | 说明 |
|---|---|
| Hive | 最常用,把 SQL(HiveQL)转成 MapReduce / Tez / Spark 任务 |
| Spark SQL | 在 Spark 上执行 SQL,性能比 Hive 好 |
| Impala | 实时 SQL 查询,速度快,但依赖 HDFS |
| Presto / Trino | 跨数据源 SQL 查询引擎 |
| HBase + Phoenix | HBase 上的 SQL 层 |
| Flink SQL | 流批一体的 SQL 支持 |
Hadoop 本身不支持 SQL,但通过 Hive、Spark SQL、Impala 等组件可以很好地支持 SQL 查询。
如果你是想选技术方案(比如“要不要上 Hadoop 做 SQL 分析”),可以告诉我你的使用场景。
免责声明:本站发布的内容(图片、视频和文字)以原创、转载和分享为主,文章观点不代表本网站立场,如果涉及侵权请联系站长邮箱:is@yisu.com进行举报,并提供相关证据,一经查实,将立刻删除涉嫌侵权内容。