-
Notifications
You must be signed in to change notification settings - Fork 133
All issues
Issue creation is restricted in this repository
Issues
is:issue state:open
is:issue state:open
Search results
[Bug]: NVSwitch health events reach no Prometheus metric: STORE_ONLY hardcoded and dcgm_health_active_events never populated
bugSomething isn't workingSomething isn't workingpriority/P1Max fix SLA: 183 daysMax fix SLA: 183 daysStatus: Open.#1902 In NVIDIA/NVSentinel;[Feature]: DRA-aware gpu-allocatable readiness criterion in lifecycle-manager for GPUCluster mode
enhancementNew feature or requestNew feature or requestpriority/P1Max fix SLA: 183 daysMax fix SLA: 183 daysStatus: Open.#1899 In NVIDIA/NVSentinel;- Status: Open.#1897 In NVIDIA/NVSentinel;
[Feature]: [labeler] Automatic GPUs detection in both GPU operator mode
enhancementNew feature or requestNew feature or requestpriority/P1Max fix SLA: 183 daysMax fix SLA: 183 daysStatus: Open.#1892 In NVIDIA/NVSentinel;Publish the chart's CRDs as a separate nvsentinel-crds chart
enhancementNew feature or requestNew feature or requestpriority/P1Max fix SLA: 183 daysMax fix SLA: 183 daysStatus: Open.#1882 In NVIDIA/NVSentinel;[Feature]: dropped Kubernetes write counters cannot distinguish a lost condition clear from a lost condition set
priority/P1Max fix SLA: 183 daysMax fix SLA: 183 daysStatus: Open.#1881 In NVIDIA/NVSentinel;KOM: three-state / restart-aware condition handling for NPD-sourced policies
priority/P2no SLA breachno SLA breachStatus: Open.[Bug]: manual uncordon leaves cordon-by/cordon-reason/cordon-timestamp labels on the node
priority/P1Max fix SLA: 183 daysMax fix SLA: 183 daysStatus: Open.#1872 In NVIDIA/NVSentinel;[Feature]: Pin CI and UAT to GPU Operator 26.7
enhancementNew feature or requestNew feature or requestpriority/P1Max fix SLA: 183 daysMax fix SLA: 183 daysStatus: Open.#1870 In NVIDIA/NVSentinel;[Bug]: Janitor GPU reset overwrites operand node labels without checking their prior values
bugSomething isn't workingSomething isn't workingpriority/P1Max fix SLA: 183 daysMax fix SLA: 183 daysStatus: Open.#1869 In NVIDIA/NVSentinel;[Feature]: Add nvidia.com/gpu.deploy.client node selector for GPU-client DaemonSets
enhancementNew feature or requestNew feature or requestpriority/P1Max fix SLA: 183 daysMax fix SLA: 183 daysStatus: Open.#1868 In NVIDIA/NVSentinel;[Feature]: Support DRA-only GPU pods in the preflight injection webhook
enhancementNew feature or requestNew feature or requestpriority/P1Max fix SLA: 183 daysMax fix SLA: 183 daysStatus: Open.#1867 In NVIDIA/NVSentinel;