大规模并行查询
采用 MPP 并行处理架构,面向大规模数据集提供高吞吐和低延迟查询能力,并支持按节点扩展容量或性能。
Apache Hadoop 原生 SQL 分析数据库Apache HAWQ® 将大规模并行处理能力、ANSI SQL 兼容性、Apache Hadoop 生态集成和多种数据存储格式支持结合在一起,可通过 HDFS 原生查询 Hadoop 数据。项目页面显示该项目已退休,并提供历史版本、文档、代码及社区资料。
从并行查询、SQL 兼容到生态管理,Apache HAWQ® 提供完整的企业分析数据库技术资料。
采用 MPP 并行处理架构,面向大规模数据集提供高吞吐和低延迟查询能力,并支持按节点扩展容量或性能。
支持复杂查询、连接、汇总和嵌套查询,便于 SQL 应用及商业智能和数据可视化工具使用既有技能。
可通过 HDFS 原生查询 Hadoop 数据,并与 Apache YARN、Apache Ambari 和 Apache HCatalog 集成管理。
支持 Apache Parquet、Apache AVRO、Apache HBase 等数据存储格式。
可与 Apache MADlib SQL 分析和机器学习库协同,用于数据科学、高级分析和现代应用开发场景。
以下内容来自 Apache HAWQ® 公开页面中的版本信息和项目公告。
公开页面声明 Apache HAWQ 项目已退休,并提示前往 Apache Attic 页面了解详情。
页面提供 HAWQ 3.0.0.0 的二进制版本和源代码下载入口,并附带发布说明、PGP 签名和 SHA-256 校验文件。
页面说明 Apache 软件基金会董事会于 2018 年 8 月 15 日批准 Apache HAWQ 成为顶级项目。
通过官方文档、代码仓库、问题跟踪和发布校验资料了解 Apache HAWQ®。