Tajo (产品编号:2967)
Apache Tajo是Hadoop上的一个大数据仓库系统。
标签:
算法
大数据
SQL
下载量: 下载量:0
收藏: 收藏:0
查看价格
试用下载
温馨提示:本产品的分类与介绍仅供参考,具体以商家网站介绍为准,如有疑问请来电023-62585653咨询。
产品介绍
动态
下载
购买
资源
Tajo
Apache Tajo 是一个健壮的 Hadoop 大数据关系型与分布式数据仓库系统,常用于低延迟、可伸缩的点对点查询、在线聚合,以及存储在 HDFS 等数据源的大数据集的提取—转换—装载。它通过对 SQL 标准的支持提供优化的查询执行。
核心功能
- 完全的分布式 SQL 查询处理引擎,支持交互式分析。
- 高级查询优化,如基于成本与渐进式优化。
- 容错性与长时间运行查询的动态调度。
- 核外算法支持比主内存更大的数据集。
- 遵从 ANSI / ISO SQL 标准。
- 支持 Hive MetaStore 访问与 JDBC 驱动。
- 支持 CSV、JSON、RCFile、SequenceFile、ORC、Parquet 等格式。
- 提供用户定义函数、交互外壳与异步/同步 Java API。
适用场景
适用于在 Hadoop 上构建低延迟 SQL 数据仓库与即席查询的场景。对需要标准 SQL 接口访问 HDFS 大数据的分析团队较为合适。
技术规格与支持平台
- Apache Tajo
- SQL/Java
- Hadoop 生态
- 授权形态:商业软件(需授权使用)
渝公网安备50010702505508