¿Alguna forma de permitir que un clúster H2O guarde/cargue directamente en S3?
model.save('s3n://my-domain/gbm-from-the-future') model.load('s3n://my-domain/gbm-from-the-future')Históricamente, he logrado esto: - Guardando en un sistema de archivos fuera del clúster - Sincronizando con S3 - Descargando desde S3 - Cargando desde el sistema de archivos
Obviamente, tiene que haber una mejor manera desde el propio clúster.
De acuerdo con los documentos de Python para h2o.save_model() esto ya es compatible (no mencionó cuál de las API está usando, así que estoy usando Python como ejemplo). ¿Ha intentado poner una dirección S3 en el argumento de ubicación del archivo de las funciones de guardar y cargar del modelo estándar? Si encuentra que esto no funciona, presente un informe de error en H2O JIRA .