So it's not data collection (similar to Google Analytics), just the query part?
It’s a query engine that can talk to multiple databases and run join queries across tables from multiple sources. It also runs as a faster alternative to Hive.
We use it to query data across multiple data sources, e.g. Elasticsearch, AWS Redshift, and S3.