Please set your HADOOP_HOME variable to the absolute path of | | the directory that contains the hadoop distribution
(参考哲学三问)
数据是什么,数据从哪里来,到哪里去
有离线业务、也有实时业务(Lambda 架构) 基于Docker搭建异构数据源,还原企业真实应用场景 以企业主流的Spark生态圈为核心技术(SQL和Streaming) Azkaban定时调度主题及指标统计分析 Kudu Impala准实时分析系统 使用Hue集成Impala进行数据即席查询 ClickHouse实时存储及计算引擎 自定义数据源实现SparkSQL与Clickhouse整合 Elasticsearch 分布式全文检索 Spring Cloud 搭建数据服务 存储与计算性能调优