Quiero escribir una aplicación de chispa en la que lea de varias tablas de colmena y escriba en varias tablas de colmena. Sin embargo, aquí está la peculiaridad.
Todas las tablas de colmena son tablas de colmena externas con datos que residen en S3.
Algunos cubos s3 requieren cifrado s3:sse al escribir y algunos cubos no.
Según tengo entendido, solo puedo establecer la propiedad fs.s3a.server-side-encryption-algorithm a nivel global.
¿Cómo hago esto? Estoy bastante seguro de que este es un caso de uso común.
Supongo que la pregunta que estoy haciendo es la siguiente.
considere que estoy leyendo desde una tabla de colmena y escribiendo en una tabla de colmena dentro de una aplicación de chispa. considere que ambas tablas de colmena son externas con datos en S3. sin embargo, la tabla lee de un depósito no cifrado y escribe en un depósito que requiere cifrado.
Hadoop 2.8.0 le permite agregar configuraciones por depósito , lo que le permitirá hacer exactamente lo que quiere; cuando actualiza Spark para usar los JAR 2.8.0, puede usar esta característica de Spark.