Repository navigation
feat(helm/gpu-operator): update v26.3.1 ➼ v26.7.1 - #7233
Open
tinfoild[bot] wants to merge 1 commit into
Open
tinfoild[bot] wants to merge 1 commit into
tinfoild[bot] wants to merge 1 commit into
Conversation
Contributor
Author
kube/helmrelease/out00--- HelmRelease: nvidia/nvidia-gpu-operator ClusterRole: nvidia/gpu-operator
+++ HelmRelease: nvidia/nvidia-gpu-operator ClusterRole: nvidia/gpu-operator
@@ -81,12 +81,19 @@
- create
- get
- list
- watch
- delete
- apiGroups:
+ - events.k8s.io
+ resources:
+ - events
+ verbs:
+ - create
+ - patch
+- apiGroups:
- ''
resources:
- pods
verbs:
- get
- list
@@ -108,12 +115,15 @@
- apiGroups:
- nvidia.com
resources:
- clusterpolicies
- clusterpolicies/finalizers
- clusterpolicies/status
+ - gpuclusters
+ - gpuclusters/finalizers
+ - gpuclusters/status
- nvidiadrivers
- nvidiadrivers/finalizers
- nvidiadrivers/status
verbs:
- create
- get
@@ -151,7 +161,79 @@
- get
- list
- watch
- update
- patch
- create
+- apiGroups:
+ - resource.nvidia.com
+ resources:
+ - computedomains
+ - computedomains/status
+ verbs:
+ - get
+ - list
+ - watch
+ - update
+ - patch
+- apiGroups:
+ - resource.nvidia.com
+ resources:
+ - computedomaincliques
+ verbs:
+ - get
+ - list
+ - watch
+ - create
+ - update
+ - patch
+- apiGroups:
+ - coordination.k8s.io
+ resources:
+ - leases
+ verbs:
+ - get
+ - create
+ - update
+- apiGroups:
+ - resource.k8s.io
+ resources:
+ - resourceclaims
+ verbs:
+ - get
+ - list
+ - watch
+- apiGroups:
+ - resource.k8s.io
+ resources:
+ - resourceclaimtemplates
+ - deviceclasses
+ - resourceslices
+ verbs:
+ - get
+ - list
+ - watch
+ - create
+ - update
+ - delete
+- apiGroups:
+ - ''
+ resources:
+ - pods
+ verbs:
+ - get
+ - list
+ - watch
+ - patch
+- apiGroups:
+ - admissionregistration.k8s.io
+ resources:
+ - validatingadmissionpolicies
+ - validatingadmissionpolicybindings
+ verbs:
+ - get
+ - list
+ - watch
+ - create
+ - update
+ - delete
--- HelmRelease: nvidia/nvidia-gpu-operator Role: nvidia/gpu-operator
+++ HelmRelease: nvidia/nvidia-gpu-operator Role: nvidia/gpu-operator
@@ -33,12 +33,24 @@
- list
- watch
- apiGroups:
- apps
resources:
- daemonsets
+ verbs:
+ - create
+ - get
+ - list
+ - watch
+ - update
+ - patch
+ - delete
+- apiGroups:
+ - apps
+ resources:
+ - deployments
verbs:
- create
- get
- list
- watch
- update
@@ -94,7 +106,8 @@
verbs:
- get
- list
- watch
- create
- update
+ - delete
--- HelmRelease: nvidia/nvidia-gpu-operator Deployment: nvidia/gpu-operator
+++ HelmRelease: nvidia/nvidia-gpu-operator Deployment: nvidia/gpu-operator
@@ -31,13 +31,13 @@
openshift.io/scc: restricted-readonly
spec:
serviceAccountName: gpu-operator
priorityClassName: system-node-critical
containers:
- name: gpu-operator
- image: nvcr.io/nvidia/gpu-operator:v26.3.1
+ image: nvcr.io/nvidia/gpu-operator:v26.7.1
imagePullPolicy: IfNotPresent
command:
- gpu-operator
args:
- --leader-elect
- --zap-time-encoding=epoch
@@ -47,13 +47,15 @@
value: ''
- name: OPERATOR_NAMESPACE
valueFrom:
fieldRef:
fieldPath: metadata.namespace
- name: DRIVER_MANAGER_IMAGE
- value: nvcr.io/nvidia/cloud-native/k8s-driver-manager:v0.10.0
+ value: nvcr.io/nvidia/cloud-native/k8s-driver-manager:v0.12.1
+ - name: VALIDATOR_IMAGE
+ value: nvcr.io/nvidia/gpu-operator:v26.7.1
livenessProbe:
httpGet:
path: /healthz
port: 8081
initialDelaySeconds: 15
periodSeconds: 20
@@ -70,12 +72,14 @@
requests:
cpu: 200m
memory: 100Mi
ports:
- name: metrics
containerPort: 8080
+ nodeSelector:
+ kubernetes.io/os: linux
affinity:
nodeAffinity:
preferredDuringSchedulingIgnoredDuringExecution:
- preference:
matchExpressions:
- key: node-role.kubernetes.io/control-plane
--- HelmRelease: nvidia/nvidia-gpu-operator ClusterPolicy: nvidia/cluster-policy
+++ HelmRelease: nvidia/nvidia-gpu-operator ClusterPolicy: nvidia/cluster-policy
@@ -14,13 +14,13 @@
rootFS: /
driverInstallDir: /usr/local
operator:
runtimeClass: nvidia
daemonsets:
labels:
- helm.sh/chart: gpu-operator-v26.3.1
+ helm.sh/chart: gpu-operator-v26.7.1
app.kubernetes.io/managed-by: gpu-operator
egress.home.arpa/apiserver: allow
tolerations:
- effect: NoSchedule
key: nvidia.com/gpu
operator: Exists
@@ -28,13 +28,13 @@
updateStrategy: RollingUpdate
rollingUpdate:
maxUnavailable: '1'
validator:
repository: nvcr.io/nvidia
image: gpu-operator
- version: v26.3.1
+ version: v26.7.1
imagePullPolicy: IfNotPresent
plugin:
env: []
mig:
strategy: single
psa:
@@ -45,26 +45,26 @@
enabled: false
useNvidiaDriverCRD: false
kernelModuleType: auto
usePrecompiled: false
repository: nvcr.io/nvidia
image: driver
- version: 580.126.20
+ version: 595.91.07
imagePullPolicy: IfNotPresent
startupProbe:
failureThreshold: 120
initialDelaySeconds: 60
periodSeconds: 10
timeoutSeconds: 60
rdma:
enabled: false
useHostMofed: false
manager:
repository: nvcr.io/nvidia/cloud-native
image: k8s-driver-manager
- version: v0.10.0
+ version: v0.12.1
imagePullPolicy: IfNotPresent
repoConfig:
configMapName: ''
certConfig:
name: ''
licensingConfig:
@@ -95,122 +95,123 @@
imagePullPolicy: IfNotPresent
kernelModuleConfig:
name: ''
driverManager:
repository: nvcr.io/nvidia/cloud-native
image: k8s-driver-manager
- version: v0.10.0
+ version: v0.12.1
imagePullPolicy: IfNotPresent
kataManager:
enabled: false
imagePullPolicy: IfNotPresent
vfioManager:
enabled: true
repository: nvcr.io/nvidia/cloud-native
image: k8s-driver-manager
- version: v0.10.0
+ version: v0.12.1
imagePullPolicy: IfNotPresent
driverManager:
repository: nvcr.io/nvidia/cloud-native
image: k8s-driver-manager
- version: v0.10.0
+ version: v0.12.1
imagePullPolicy: IfNotPresent
vgpuDeviceManager:
enabled: true
repository: nvcr.io/nvidia/cloud-native
image: vgpu-device-manager
- version: v0.4.2
+ version: v0.5.1
imagePullPolicy: IfNotPresent
config:
default: default
name: ''
ccManager:
enabled: true
defaultMode: 'on'
repository: nvcr.io/nvidia/cloud-native
image: k8s-cc-manager
- version: v0.4.0
+ version: v0.4.4
imagePullPolicy: IfNotPresent
toolkit:
enabled: false
repository: nvcr.io/nvidia/k8s
image: container-toolkit
- version: v1.19.0
+ version: v1.20.1
imagePullPolicy: IfNotPresent
installDir: /usr/local/nvidia
devicePlugin:
enabled: true
repository: nvcr.io/nvidia
image: k8s-device-plugin
- version: v0.19.0
+ version: v0.20.1
imagePullPolicy: IfNotPresent
dcgm:
enabled: false
repository: nvcr.io/nvidia/cloud-native
image: dcgm
- version: 4.5.2-1-ubuntu22.04
+ version: 4.6.1-1-ubuntu24.04
imagePullPolicy: IfNotPresent
dcgmExporter:
enabled: true
repository: nvcr.io/nvidia/k8s
image: dcgm-exporter
- version: 4.5.1-4.8.0-distroless
+ version: 4.6.1-4.8.4-distroless
imagePullPolicy: IfNotPresent
serviceMonitor:
additionalLabels: {}
- enabled: false
+ enabled: true
honorLabels: false
interval: 15s
relabelings: []
+ scrapeTimeout: 10s
service:
internalTrafficPolicy: Cluster
gfd:
enabled: true
repository: nvcr.io/nvidia
image: k8s-device-plugin
- version: v0.19.0
+ version: v0.20.1
imagePullPolicy: IfNotPresent
migManager:
enabled: true
repository: nvcr.io/nvidia/cloud-native
image: k8s-mig-manager
- version: v0.14.0
+ version: v0.15.1
imagePullPolicy: IfNotPresent
config:
default: all-disabled
gpuClientsConfig:
name: ''
nodeStatusExporter:
enabled: false
repository: nvcr.io/nvidia
image: gpu-operator
- version: v26.3.1
+ version: v26.7.1
imagePullPolicy: IfNotPresent
gds:
enabled: false
repository: nvcr.io/nvidia/cloud-native
image: nvidia-fs
- version: 2.27.3
+ version: 2.29.4
imagePullPolicy: IfNotPresent
gdrcopy:
enabled: false
repository: nvcr.io/nvidia/cloud-native
image: gdrdrv
- version: v2.5.2
+ version: v2.6
imagePullPolicy: IfNotPresent
sandboxWorkloads:
enabled: false
defaultWorkload: container
mode: kubevirt
sandboxDevicePlugin:
enabled: true
repository: nvcr.io/nvidia
image: kubevirt-gpu-device-plugin
- version: v1.5.0
+ version: v1.6.0
imagePullPolicy: IfNotPresent
kataSandboxDevicePlugin:
enabled: true
repository: nvcr.io/nvidia/cloud-native
image: nvidia-sandbox-device-plugin
- version: v0.0.3
+ version: v0.0.5
imagePullPolicy: IfNotPresent
--- HelmRelease: nvidia/nvidia-gpu-operator Job: nvidia/gpu-operator-upgrade-crd
+++ HelmRelease: nvidia/nvidia-gpu-operator Job: nvidia/gpu-operator-upgrade-crd
@@ -28,18 +28,21 @@
serviceAccountName: gpu-operator-upgrade-crd-hook-sa
tolerations:
- effect: NoSchedule
key: node-role.kubernetes.io/control-plane
operator: Equal
value: ''
+ nodeSelector:
+ kubernetes.io/os: linux
containers:
- name: upgrade-crd
- image: nvcr.io/nvidia/gpu-operator:v26.3.1
+ image: nvcr.io/nvidia/gpu-operator:v26.7.1
imagePullPolicy: IfNotPresent
command:
- /usr/bin/manage-crds
args:
- apply
- --filepath=/opt/gpu-operator/nvidia.com_clusterpolicies.yaml
- --filepath=/opt/gpu-operator/nvidia.com_nvidiadrivers.yaml
+ - --filepath=/opt/gpu-operator/nvidia.com_gpuclusters.yaml
restartPolicy: OnFailure
--- HelmRelease: nvidia/nvidia-gpu-operator Job: nvidia/gpu-operator-cleanup-gpucluster
+++ HelmRelease: nvidia/nvidia-gpu-operator Job: nvidia/gpu-operator-cleanup-gpucluster
@@ -0,0 +1,45 @@
+---
+apiVersion: batch/v1
+kind: Job
+metadata:
+ name: gpu-operator-cleanup-gpucluster
+ namespace: nvidia
+ annotations:
+ helm.sh/hook: pre-delete
+ helm.sh/hook-weight: '0'
+ helm.sh/hook-delete-policy: hook-succeeded,before-hook-creation
+ labels:
+ app.kubernetes.io/name: gpu-operator
+ app.kubernetes.io/instance: nvidia-gpu-operator
+ app.kubernetes.io/managed-by: Helm
+ egress.home.arpa/apiserver: allow
+ app.kubernetes.io/component: gpu-operator
+spec:
+ template:
+ metadata:
+ name: gpu-operator-cleanup-gpucluster
+ labels:
+ app.kubernetes.io/name: gpu-operator
+ app.kubernetes.io/instance: nvidia-gpu-operator
+ app.kubernetes.io/managed-by: Helm
+ egress.home.arpa/apiserver: allow
+ app.kubernetes.io/component: gpu-operator
+ spec:
+ serviceAccountName: gpu-operator
+ tolerations:
+ - effect: NoSchedule
+ key: node-role.kubernetes.io/control-plane
+ operator: Equal
+ value: ''
+ nodeSelector:
+ kubernetes.io/os: linux
+ containers:
+ - name: cleanup-gpucluster
+ image: nvcr.io/nvidia/gpu-operator:v26.7.1
+ imagePullPolicy: IfNotPresent
+ command:
+ - /usr/bin/cleanup-gpuclusters
+ - --gpucluster-name
+ - gpu-cluster
+ restartPolicy: OnFailure
+ |
tinfoild
Bot
force-pushed
the
renovate/gpu-operator-26.x
branch
from
September 23, 2026 06:16
005d89f to
c8cc827
Compare
This file contains hidden or bidirectional Unicode text that may be interpreted or compiled differently than what appears below. To review, open the file in an editor that reveals hidden Unicode characters.
Learn more about bidirectional Unicode characters
Sign up for free
to join this conversation on GitHub.
Already have an account?
Sign in to comment
Add this suggestion to a batch that can be applied as a single commit.This suggestion is invalid because no changes were made to the code.Suggestions cannot be applied while the pull request is closed.Suggestions cannot be applied while viewing a subset of changes.Only one suggestion per line can be applied in a batch.Add this suggestion to a batch that can be applied as a single commit.Applying suggestions on deleted lines is not supported.You must change the existing code in this line in order to create a valid suggestion.Outdated suggestions cannot be applied.This suggestion has been applied or marked resolved.Suggestions cannot be applied from pending reviews.Suggestions cannot be applied on multi-line comments.Suggestions cannot be applied while the pull request is queued to merge.Suggestion cannot be applied right now. Please check back later.
This PR contains the following updates:
v26.3.1→v26.7.1Warning
Some dependencies could not be looked up. Check the Dependency Dashboard for more information.
Release Notes
NVIDIA/gpu-operator (gpu-operator)
v26.7.1: GPU Operator 26.7.1 ReleaseCompare Source
https://docs.nvidia.com/datacenter/cloud-native/gpu-operator/26.7/release-notes.html#v26-7-1
v26.7.0: GPU Operator 26.7.0 ReleaseCompare Source
https://docs.nvidia.com/datacenter/cloud-native/gpu-operator/26.7/release-notes.html#v26-7-0
v26.3.3: GPU Operator 26.3.3 ReleaseCompare Source
https://docs.nvidia.com/datacenter/cloud-native/gpu-operator/latest/release-notes.html#v26-3-3
v26.3.2: GPU Operator 26.3.2 ReleaseCompare Source
https://docs.nvidia.com/datacenter/cloud-native/gpu-operator/latest/release-notes.html#v26-3-2
Configuration
📅 Schedule: (in timezone Asia/Singapore)
🚦 Automerge: Disabled by config. Please merge this manually once you are satisfied.
♻ Rebasing: Whenever PR becomes conflicted, or you tick the rebase/retry checkbox.
🔕 Ignore: Close this PR and you won't be reminded about this update again.
This PR has been generated by Mend Renovate.