Usando el módulo EKS de terraform , ¿cómo se usan los nodos de GPU?
Los documentos de EKS sugieren que la compatibilidad con GPU es automática, pero algunas guías/tutoriales sugieren que el usuario debe instalar el complemento nvidia-device-plugin y configurar las AMI por sí mismo.
Debe indicar a los grupos de trabajadores que utilicen una imagen AMI específica e instalar el complemento de dispositivo NVIDIA.
Hay una propiedad image_id para el bloque worker_groups .
Encuentre la imagen de AMI adecuada aquí , seleccionando el enlace x86 accelerated en la versión de kubernetes y la región de AWS adecuadas para su clúster. Copie la identificación de AMI, por ejemplo, para k8s 1.18 en eu-west-2, necesita ami-027a09e5aa5a67e59 .
Luego, ingrese su ID de AMI como image_id en su configuración de worker_groups por ejemplo:
module "eks" { worker_groups = [ { image_id = "ami-027a09e5aa5a67e59" } ] }Finalmente, debe instalar nvidia-device-plugin , que se puede realizar dentro de terraform usando el proveedor de helm :
resource "helm_release" "k8s-device-plugin" { name = "k8s-device-plugin" repository = "https://nvidia.github.io/k8s-device-plugin" chart = "nvidia-device-plugin" version = "0.6.0" namespace = "kube-system" } Ahora debería poder ejecutar pods de GPU solicitando el tipo de recurso nvidia.com/gpu .