-
Notifications
You must be signed in to change notification settings - Fork 129
All issues
Issue creation is restricted in this repository
Issues
is:issue state:open
is:issue state:open
Search results
[Bug]: Missing process critical errors
bugSomething isn't workingSomething isn't workingStatus: Open.#1826 In NVIDIA/NVSentinel;[Bug]: GPU health monitor drops or misattributes DCGM NVSwitch incidents
bugSomething isn't workingSomething isn't workingStatus: Open.#1824 In NVIDIA/NVSentinel;[Bug]: slinky-drainer caches every Pod in the cluster instead of only the Slinky namespace
bugSomething isn't workingSomething isn't workingpriority/P1Max fix SLA: 183 daysMax fix SLA: 183 daysStatus: Open.[Bug]:
RebootNode'sforcefield is not respected on CSP requestbugSomething isn't workingSomething isn't workingStatus: Open.#1818 In NVIDIA/NVSentinel;[Feature]: Derive fault-quarantine's node cache transform from the CEL rules
enhancementNew feature or requestNew feature or requestpriority/P1Max fix SLA: 183 daysMax fix SLA: 183 daysStatus: Open.#1810 In NVIDIA/NVSentinel;[Feature]: Queue a document ID on fault-remediation's live path, as #1627 did for cold start
enhancementNew feature or requestNew feature or requestpriority/P1Max fix SLA: 183 daysMax fix SLA: 183 daysStatus: Open.#1801 In NVIDIA/NVSentinel;[Feature]: Process health events concurrently, partitioned by node
enhancementNew feature or requestNew feature or requestpriority/P2no SLA breachno SLA breachStatus: Open.#1800 In NVIDIA/NVSentinel;[Feature]: bundled Percona versions move with an NVSentinel release, unguarded and unannounced, and can skip a minor or roll the datastore
priority/P1Max fix SLA: 183 daysMax fix SLA: 183 daysStatus: Open.#1797 In NVIDIA/NVSentinel;[Bug]: the incident accumulator keeps only the first error code per (watch, GPU), so a second code on the same GPU is silently dropped
priority/P1Max fix SLA: 183 daysMax fix SLA: 183 daysStatus: Open.#1795 In NVIDIA/NVSentinel;[Feature]: Bound PolicyEndpoint growth from NVSentinel's namespace-wide NetworkPolicy at fleet scale
enhancementNew feature or requestNew feature or requestpriority/P1Max fix SLA: 183 daysMax fix SLA: 183 daysStatus: Open.#1792 In NVIDIA/NVSentinel;[Feature]: GPU reset cannot be extended without forking janitor
priority/P1Max fix SLA: 183 daysMax fix SLA: 183 daysStatus: Open.#1782 In NVIDIA/NVSentinel;[Feature]: Manage postgres schema in a versioned manner
enhancementNew feature or requestNew feature or requestpriority/P1Max fix SLA: 183 daysMax fix SLA: 183 daysStatus: Open.#1772 In NVIDIA/NVSentinel;