We use it to query data across multiple data sources, e.g. Elasticsearch, AWS Redshift, and S3.
It’s a query engine that can talk to multiple databases and run join queries across tables from multiple sources. It also runs as a faster alternative to Hive.