Hue 手记:功能范围、数据源列表与 Docker 快速启动
Hue(Hadoop User Experience)是一个用于大数据平台、数据库以及数据仓库查询的开源工具,提供统一的 Web 界面,目标是简化用户与 Hadoop 生态系统以及各种数据存储的交互。
支持的数据源类型
- 数据库:Apache Hive、Apache Impala、MySQL、Presto、Trino、Oracle、PostgreSQL、AWS Athena、Apache Phoenix、Apache Druid、Apache Flink、ksqlDB、Google BigQuery、Materialize、Teradata、DB2、Apache Spark SQL、Azure SQL Database、MS SQL Server、Vertica、AWS Redshift、Apache Drill、SAP Sybase、SAP Hana、Apache Solr、Apache Kylin、Dask SQL、Clickhouse、Apache Kyuubi、Elastic Search、Apache Pinot DB、Snowflake、Sqlite、Google Sheets、Greenplum
- 存储:HDFS、Apache Ozone、S3、Azure File Systems、GCS、HBase
- 元数据:Apache Atlas
- 任务调度:Apache Spark、Apache Pig、Apache Oozie、Apache YARN、Apache Sentry、Apache Knox
主要功能
- SQL 编辑器:支持智能语法补全、查询优化和文档辅助。
- Dashboard(面板):通过拖拽方式构建交互式分析。
- 可视化:支持饼图、折线图、柱状图、时序图、散点图、地图等图表类型。
- 数据浏览与管理:通过数据目录搜索表与存储,快速定位并分析数据。
- 任务调度与监控:集成 Oozie 工作流、YARN 任务监控。
- 分享:可分享 SQL 查询、工作流、面板等内容。
用 Docker 快速体验
在终端执行:
docker run -it -p 8888:8888 gethue/hue:latest
然后在浏览器访问:
http://localhost:8888/
首次进入需要创建超级管理员账号:填写用户名和密码后,点击 Create Account 完成创建并登录。
官方文档: