This looks like it might a good fit for data flow/transform/etl type workflows.
1. Does this work in a clustered/distributed environment? 2. Does this integrate with Hadoop/Mapreduce/Yarn/Kafka? 3. If it doesn't integrate with hadoop, how hard would it be to integrate it, do you think?