Skip to content

feat(helm/gpu-operator): update v26.3.1 ➼ v26.7.1 - #7233

Open
tinfoild[bot] wants to merge 1 commit into
mainfrom
renovate/gpu-operator-26.x
Open

tinfoild[bot] wants to merge 1 commit into
mainfrom
renovate/gpu-operator-26.x

Conversation

@tinfoild

@tinfoild tinfoild Bot commented Aug 24, 2026 •

Copy link
Copy Markdown
Contributor

This PR contains the following updates:

Package Update Change OpenSSF
gpu-operator (source) minor v26.3.1 → v26.7.1 OpenSSF Scorecard

Warning

Some dependencies could not be looked up. Check the Dependency Dashboard for more information.


Release Notes

NVIDIA/gpu-operator (gpu-operator)

v26.7.1: GPU Operator 26.7.1 Release

Compare Source

https://docs.nvidia.com/datacenter/cloud-native/gpu-operator/26.7/release-notes.html#v26-7-1

v26.7.0: GPU Operator 26.7.0 Release

Compare Source

https://docs.nvidia.com/datacenter/cloud-native/gpu-operator/26.7/release-notes.html#v26-7-0

v26.3.3: GPU Operator 26.3.3 Release

Compare Source

https://docs.nvidia.com/datacenter/cloud-native/gpu-operator/latest/release-notes.html#v26-3-3

v26.3.2: GPU Operator 26.3.2 Release

Compare Source

https://docs.nvidia.com/datacenter/cloud-native/gpu-operator/latest/release-notes.html#v26-3-2


Configuration

📅 Schedule: (in timezone Asia/Singapore)

  • Branch creation
    • At any time (no schedule defined)
  • Automerge
    • At any time (no schedule defined)

🚦 Automerge: Disabled by config. Please merge this manually once you are satisfied.

♻ Rebasing: Whenever PR becomes conflicted, or you tick the rebase/retry checkbox.

🔕 Ignore: Close this PR and you won't be reminded about this update again.


  • If you want to rebase/retry this PR, check this box

This PR has been generated by Mend Renovate.

@cloudflare-workers-and-pages

cloudflare-workers-and-pages Bot commented Aug 24, 2026 •

Copy link
Copy Markdown

Deploying jjgadgets-biohazard with  Cloudflare Pages  Cloudflare Pages

Latest commit: c8cc827
Status:🚫  Build failed.

View logs

@tinfoild

tinfoild Bot commented Aug 24, 2026 •

Copy link
Copy Markdown
Contributor Author

kube/helmrelease/out00

--- HelmRelease: nvidia/nvidia-gpu-operator ClusterRole: nvidia/gpu-operator

+++ HelmRelease: nvidia/nvidia-gpu-operator ClusterRole: nvidia/gpu-operator

@@ -81,12 +81,19 @@

   - create
   - get
   - list
   - watch
   - delete
 - apiGroups:
+  - events.k8s.io
+  resources:
+  - events
+  verbs:
+  - create
+  - patch
+- apiGroups:
   - ''
   resources:
   - pods
   verbs:
   - get
   - list
@@ -108,12 +115,15 @@

 - apiGroups:
   - nvidia.com
   resources:
   - clusterpolicies
   - clusterpolicies/finalizers
   - clusterpolicies/status
+  - gpuclusters
+  - gpuclusters/finalizers
+  - gpuclusters/status
   - nvidiadrivers
   - nvidiadrivers/finalizers
   - nvidiadrivers/status
   verbs:
   - create
   - get
@@ -151,7 +161,79 @@

   - get
   - list
   - watch
   - update
   - patch
   - create
+- apiGroups:
+  - resource.nvidia.com
+  resources:
+  - computedomains
+  - computedomains/status
+  verbs:
+  - get
+  - list
+  - watch
+  - update
+  - patch
+- apiGroups:
+  - resource.nvidia.com
+  resources:
+  - computedomaincliques
+  verbs:
+  - get
+  - list
+  - watch
+  - create
+  - update
+  - patch
+- apiGroups:
+  - coordination.k8s.io
+  resources:
+  - leases
+  verbs:
+  - get
+  - create
+  - update
+- apiGroups:
+  - resource.k8s.io
+  resources:
+  - resourceclaims
+  verbs:
+  - get
+  - list
+  - watch
+- apiGroups:
+  - resource.k8s.io
+  resources:
+  - resourceclaimtemplates
+  - deviceclasses
+  - resourceslices
+  verbs:
+  - get
+  - list
+  - watch
+  - create
+  - update
+  - delete
+- apiGroups:
+  - ''
+  resources:
+  - pods
+  verbs:
+  - get
+  - list
+  - watch
+  - patch
+- apiGroups:
+  - admissionregistration.k8s.io
+  resources:
+  - validatingadmissionpolicies
+  - validatingadmissionpolicybindings
+  verbs:
+  - get
+  - list
+  - watch
+  - create
+  - update
+  - delete
 
--- HelmRelease: nvidia/nvidia-gpu-operator Role: nvidia/gpu-operator

+++ HelmRelease: nvidia/nvidia-gpu-operator Role: nvidia/gpu-operator

@@ -33,12 +33,24 @@

   - list
   - watch
 - apiGroups:
   - apps
   resources:
   - daemonsets
+  verbs:
+  - create
+  - get
+  - list
+  - watch
+  - update
+  - patch
+  - delete
+- apiGroups:
+  - apps
+  resources:
+  - deployments
   verbs:
   - create
   - get
   - list
   - watch
   - update
@@ -94,7 +106,8 @@

   verbs:
   - get
   - list
   - watch
   - create
   - update
+  - delete
 
--- HelmRelease: nvidia/nvidia-gpu-operator Deployment: nvidia/gpu-operator

+++ HelmRelease: nvidia/nvidia-gpu-operator Deployment: nvidia/gpu-operator

@@ -31,13 +31,13 @@

         openshift.io/scc: restricted-readonly
     spec:
       serviceAccountName: gpu-operator
       priorityClassName: system-node-critical
       containers:
       - name: gpu-operator
-        image: nvcr.io/nvidia/gpu-operator:v26.3.1
+        image: nvcr.io/nvidia/gpu-operator:v26.7.1
         imagePullPolicy: IfNotPresent
         command:
         - gpu-operator
         args:
         - --leader-elect
         - --zap-time-encoding=epoch
@@ -47,13 +47,15 @@

           value: ''
         - name: OPERATOR_NAMESPACE
           valueFrom:
             fieldRef:
               fieldPath: metadata.namespace
         - name: DRIVER_MANAGER_IMAGE
-          value: nvcr.io/nvidia/cloud-native/k8s-driver-manager:v0.10.0
+          value: nvcr.io/nvidia/cloud-native/k8s-driver-manager:v0.12.1
+        - name: VALIDATOR_IMAGE
+          value: nvcr.io/nvidia/gpu-operator:v26.7.1
         livenessProbe:
           httpGet:
             path: /healthz
             port: 8081
           initialDelaySeconds: 15
           periodSeconds: 20
@@ -70,12 +72,14 @@

           requests:
             cpu: 200m
             memory: 100Mi
         ports:
         - name: metrics
           containerPort: 8080
+      nodeSelector:
+        kubernetes.io/os: linux
       affinity:
         nodeAffinity:
           preferredDuringSchedulingIgnoredDuringExecution:
           - preference:
               matchExpressions:
               - key: node-role.kubernetes.io/control-plane
--- HelmRelease: nvidia/nvidia-gpu-operator ClusterPolicy: nvidia/cluster-policy

+++ HelmRelease: nvidia/nvidia-gpu-operator ClusterPolicy: nvidia/cluster-policy

@@ -14,13 +14,13 @@

     rootFS: /
     driverInstallDir: /usr/local
   operator:
     runtimeClass: nvidia
   daemonsets:
     labels:
-      helm.sh/chart: gpu-operator-v26.3.1
+      helm.sh/chart: gpu-operator-v26.7.1
       app.kubernetes.io/managed-by: gpu-operator
       egress.home.arpa/apiserver: allow
     tolerations:
     - effect: NoSchedule
       key: nvidia.com/gpu
       operator: Exists
@@ -28,13 +28,13 @@

     updateStrategy: RollingUpdate
     rollingUpdate:
       maxUnavailable: '1'
   validator:
     repository: nvcr.io/nvidia
     image: gpu-operator
-    version: v26.3.1
+    version: v26.7.1
     imagePullPolicy: IfNotPresent
     plugin:
       env: []
   mig:
     strategy: single
   psa:
@@ -45,26 +45,26 @@

     enabled: false
     useNvidiaDriverCRD: false
     kernelModuleType: auto
     usePrecompiled: false
     repository: nvcr.io/nvidia
     image: driver
-    version: 580.126.20
+    version: 595.91.07
     imagePullPolicy: IfNotPresent
     startupProbe:
       failureThreshold: 120
       initialDelaySeconds: 60
       periodSeconds: 10
       timeoutSeconds: 60
     rdma:
       enabled: false
       useHostMofed: false
     manager:
       repository: nvcr.io/nvidia/cloud-native
       image: k8s-driver-manager
-      version: v0.10.0
+      version: v0.12.1
       imagePullPolicy: IfNotPresent
     repoConfig:
       configMapName: ''
     certConfig:
       name: ''
     licensingConfig:
@@ -95,122 +95,123 @@

     imagePullPolicy: IfNotPresent
     kernelModuleConfig:
       name: ''
     driverManager:
       repository: nvcr.io/nvidia/cloud-native
       image: k8s-driver-manager
-      version: v0.10.0
+      version: v0.12.1
       imagePullPolicy: IfNotPresent
   kataManager:
     enabled: false
     imagePullPolicy: IfNotPresent
   vfioManager:
     enabled: true
     repository: nvcr.io/nvidia/cloud-native
     image: k8s-driver-manager
-    version: v0.10.0
+    version: v0.12.1
     imagePullPolicy: IfNotPresent
     driverManager:
       repository: nvcr.io/nvidia/cloud-native
       image: k8s-driver-manager
-      version: v0.10.0
+      version: v0.12.1
       imagePullPolicy: IfNotPresent
   vgpuDeviceManager:
     enabled: true
     repository: nvcr.io/nvidia/cloud-native
     image: vgpu-device-manager
-    version: v0.4.2
+    version: v0.5.1
     imagePullPolicy: IfNotPresent
     config:
       default: default
       name: ''
   ccManager:
     enabled: true
     defaultMode: 'on'
     repository: nvcr.io/nvidia/cloud-native
     image: k8s-cc-manager
-    version: v0.4.0
+    version: v0.4.4
     imagePullPolicy: IfNotPresent
   toolkit:
     enabled: false
     repository: nvcr.io/nvidia/k8s
     image: container-toolkit
-    version: v1.19.0
+    version: v1.20.1
     imagePullPolicy: IfNotPresent
     installDir: /usr/local/nvidia
   devicePlugin:
     enabled: true
     repository: nvcr.io/nvidia
     image: k8s-device-plugin
-    version: v0.19.0
+    version: v0.20.1
     imagePullPolicy: IfNotPresent
   dcgm:
     enabled: false
     repository: nvcr.io/nvidia/cloud-native
     image: dcgm
-    version: 4.5.2-1-ubuntu22.04
+    version: 4.6.1-1-ubuntu24.04
     imagePullPolicy: IfNotPresent
   dcgmExporter:
     enabled: true
     repository: nvcr.io/nvidia/k8s
     image: dcgm-exporter
-    version: 4.5.1-4.8.0-distroless
+    version: 4.6.1-4.8.4-distroless
     imagePullPolicy: IfNotPresent
     serviceMonitor:
       additionalLabels: {}
-      enabled: false
+      enabled: true
       honorLabels: false
       interval: 15s
       relabelings: []
+      scrapeTimeout: 10s
     service:
       internalTrafficPolicy: Cluster
   gfd:
     enabled: true
     repository: nvcr.io/nvidia
     image: k8s-device-plugin
-    version: v0.19.0
+    version: v0.20.1
     imagePullPolicy: IfNotPresent
   migManager:
     enabled: true
     repository: nvcr.io/nvidia/cloud-native
     image: k8s-mig-manager
-    version: v0.14.0
+    version: v0.15.1
     imagePullPolicy: IfNotPresent
     config:
       default: all-disabled
     gpuClientsConfig:
       name: ''
   nodeStatusExporter:
     enabled: false
     repository: nvcr.io/nvidia
     image: gpu-operator
-    version: v26.3.1
+    version: v26.7.1
     imagePullPolicy: IfNotPresent
   gds:
     enabled: false
     repository: nvcr.io/nvidia/cloud-native
     image: nvidia-fs
-    version: 2.27.3
+    version: 2.29.4
     imagePullPolicy: IfNotPresent
   gdrcopy:
     enabled: false
     repository: nvcr.io/nvidia/cloud-native
     image: gdrdrv
-    version: v2.5.2
+    version: v2.6
     imagePullPolicy: IfNotPresent
   sandboxWorkloads:
     enabled: false
     defaultWorkload: container
     mode: kubevirt
   sandboxDevicePlugin:
     enabled: true
     repository: nvcr.io/nvidia
     image: kubevirt-gpu-device-plugin
-    version: v1.5.0
+    version: v1.6.0
     imagePullPolicy: IfNotPresent
   kataSandboxDevicePlugin:
     enabled: true
     repository: nvcr.io/nvidia/cloud-native
     image: nvidia-sandbox-device-plugin
-    version: v0.0.3
+    version: v0.0.5
     imagePullPolicy: IfNotPresent
 
--- HelmRelease: nvidia/nvidia-gpu-operator Job: nvidia/gpu-operator-upgrade-crd

+++ HelmRelease: nvidia/nvidia-gpu-operator Job: nvidia/gpu-operator-upgrade-crd

@@ -28,18 +28,21 @@

       serviceAccountName: gpu-operator-upgrade-crd-hook-sa
       tolerations:
       - effect: NoSchedule
         key: node-role.kubernetes.io/control-plane
         operator: Equal
         value: ''
+      nodeSelector:
+        kubernetes.io/os: linux
       containers:
       - name: upgrade-crd
-        image: nvcr.io/nvidia/gpu-operator:v26.3.1
+        image: nvcr.io/nvidia/gpu-operator:v26.7.1
         imagePullPolicy: IfNotPresent
         command:
         - /usr/bin/manage-crds
         args:
         - apply
         - --filepath=/opt/gpu-operator/nvidia.com_clusterpolicies.yaml
         - --filepath=/opt/gpu-operator/nvidia.com_nvidiadrivers.yaml
+        - --filepath=/opt/gpu-operator/nvidia.com_gpuclusters.yaml
       restartPolicy: OnFailure
 
--- HelmRelease: nvidia/nvidia-gpu-operator Job: nvidia/gpu-operator-cleanup-gpucluster

+++ HelmRelease: nvidia/nvidia-gpu-operator Job: nvidia/gpu-operator-cleanup-gpucluster

@@ -0,0 +1,45 @@

+---
+apiVersion: batch/v1
+kind: Job
+metadata:
+  name: gpu-operator-cleanup-gpucluster
+  namespace: nvidia
+  annotations:
+    helm.sh/hook: pre-delete
+    helm.sh/hook-weight: '0'
+    helm.sh/hook-delete-policy: hook-succeeded,before-hook-creation
+  labels:
+    app.kubernetes.io/name: gpu-operator
+    app.kubernetes.io/instance: nvidia-gpu-operator
+    app.kubernetes.io/managed-by: Helm
+    egress.home.arpa/apiserver: allow
+    app.kubernetes.io/component: gpu-operator
+spec:
+  template:
+    metadata:
+      name: gpu-operator-cleanup-gpucluster
+      labels:
+        app.kubernetes.io/name: gpu-operator
+        app.kubernetes.io/instance: nvidia-gpu-operator
+        app.kubernetes.io/managed-by: Helm
+        egress.home.arpa/apiserver: allow
+        app.kubernetes.io/component: gpu-operator
+    spec:
+      serviceAccountName: gpu-operator
+      tolerations:
+      - effect: NoSchedule
+        key: node-role.kubernetes.io/control-plane
+        operator: Equal
+        value: ''
+      nodeSelector:
+        kubernetes.io/os: linux
+      containers:
+      - name: cleanup-gpucluster
+        image: nvcr.io/nvidia/gpu-operator:v26.7.1
+        imagePullPolicy: IfNotPresent
+        command:
+        - /usr/bin/cleanup-gpuclusters
+        - --gpucluster-name
+        - gpu-cluster
+      restartPolicy: OnFailure
+

@tinfoild
tinfoild Bot force-pushed the renovate/gpu-operator-26.x branch from 005d89f to c8cc827 Compare September 23, 2026 06:16
@tinfoild tinfoild Bot changed the title feat(helm/gpu-operator): update v26.3.1 ➼ v26.7.0 feat(helm/gpu-operator): update v26.3.1 ➼ v26.7.1 Sep 23, 2026
Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Projects

None yet

Development

Successfully merging this pull request may close these issues.

0 participants