Utiliser le GPU
Les GPUs sont accessibles grâce à la fonctionnalité DRA (Dynamic Resource Allocation) de Kubernetes.
Si votre namespace est autorisé à consommer du GPU, vous pouvez voir les ResourceClaimTemplate qui peuvent être utilisés :
kubectl get resourceclaimtemplates
NAME AGE
gpu-l40s 136m
Vous pouvez alors demander un GPU dans votre déploiement grâce à un claim :
apiVersion: apps/v1
kind: Deployment
metadata:
...
spec:
template:
metadata:
...
spec:
containers:
...
resources:
claims:
- name: gpu
limits:
...
requests:
...
resourceClaims:
- name: gpu
resourceClaimTemplateName: gpu-l40s
tolerations:
- effect: NoSchedule
key: nvidia.com/gpu
operator: Exists