DRAйверы для GPU: как Kubernetes научился выделять устройства через стандартный APIDevice Plugin в Kubernetes сводит GPU к счётчику на узле: планировщик видит только количество устройств, но не их профиль, объём памяти или режим шаринга. Для ML-задач это быстро становится ограничением. Обучению нужны выделенные карточки целиком, инференсу — управляемые доли, а CI хватит и четвертинки NVIDIA H100 на пять минут. Dynamic Resource Allocation полностью меняет модель управления устройствами. GPU становятся сущностью с инвентарём, атрибутами и правилами выбора. В статье я разбираю устройство DRA и показываю миграцию с device plugin на примере кластера из 8 узлов × 8 NVIDIA H100 без полного переписывания манифестов. А ещё объясняю, почему мы в Deckhouse пишем свой DRA-драйвер. Разобраться с DRAhttps://habr.com/ru/companies/flant/articles/1038000/#gpu #kubernetes #deckhouse_kubernetes_platform #ai #ml #dra #machine_learning
Related
Be wary of the evolution of Dunning-Kruger. #AI
Be wary of the evolution of Dunning-Kruger. #AI
🕹️ Porklike - It's the turn of the ZX Spectrum to get a port of a Pico 8 game!HairyViking has released the ZX Spectrum p...
🕹️ Porklike - It's the turn of the ZX Spectrum to get a port of a Pico 8 game!HairyViking has released the ZX Spectrum port of Porklike, a classic, turn-based roguelike originally ...
Anthropic's New Claude Opus 5 Nearly Matches Flagship Fable 5 at Half the Cost www.macrumors.com/2026/07/24/ant… #AI #An...
Anthropic's New Claude Opus 5 Nearly Matches Flagship Fable 5 at Half the Cost www.macrumors.com/2026/07/24/ant… #AI #Anthropic