Utiliser le GPU

Les GPUs sont accessibles grâce à la fonctionnalité DRA (Dynamic Resource Allocation) de Kubernetes.

Si votre namespace est autorisé à consommer du GPU, vous pouvez voir les ResourceClaimTemplate qui peuvent être utilisés :

kubectl get resourceclaimtemplates
NAME           AGE
gpu-l40s       136m

Vous pouvez alors demander un GPU dans votre déploiement grâce à un claim :

apiVersion: apps/v1
kind: Deployment
metadata:
  ...
spec:
  template:
    metadata:
      ...
    spec:
       containers:
         ...
         resources:
           claims:
           - name: gpu
           limits:
             ...
           requests:
             ...
       resourceClaims:
       - name: gpu
         resourceClaimTemplateName: gpu-l40s
       tolerations:
       - effect: NoSchedule
         key: nvidia.com/gpu
         operator: Exists