Ari Huttunen
06/12/2023, 9:39 AMjava.lang.NoClassDefFoundError: org/apache/hadoop/conf/Configuration, and they get solved by adding the following to lib directory with Ansible, but is this how we're supposed to fix this? Edit: version 1.17.1, and the plugins were copied as instructed by the manual, we're using pyflink.
flink_dependencies:
- group_id: org.apache.flink
artifact_id: flink-sql-parquet
version: "{{ flink_version }}"
- group_id: org.apache.hadoop
artifact_id: hadoop-common
version: "{{ hadoop_version }}"
- group_id: org.apache.hadoop
artifact_id: hadoop-mapreduce-client-core
version: "{{ hadoop_version }}"
- group_id: com.fasterxml.woodstox
artifact_id: woodstox-core
version: 5.3.0
- group_id: org.codehaus.woodstox
artifact_id: stax2-api
version: 4.2.1
- group_id: com.google.guava
artifact_id: guava
version: 11.0.2
- group_id: commons-logging
artifact_id: commons-logging
version: 1.1.3Martijn Visser
06/12/2023, 10:24 AMHADOOP_CLASSPATH option as outlined in https://nightlies.apache.org/flink/flink-docs-master/docs/dev/configuration/advanced/#hadoop-dependenciesAri Huttunen
06/12/2023, 11:00 AMAri Huttunen
06/12/2023, 11:01 AMMartijn Visser
06/12/2023, 11:04 AMMartijn Visser
06/12/2023, 11:05 AMAri Huttunen
06/12/2023, 11:27 AMAri Huttunen
06/12/2023, 11:27 AMMartijn Visser
06/12/2023, 11:29 AMMartijn Visser
06/12/2023, 11:30 AMMartijn Visser
06/12/2023, 11:30 AMStill, adding those jars works also.Yes, it does indeed for Parquet. But it's different if you for example want to run Flink on YARN, want to use Kerberos etc.
Ari Huttunen
06/12/2023, 11:31 AMMartijn Visser
06/12/2023, 11:32 AM