Управление драйверами NVIDIA на Proxmox для локальных LLM на рабочем столе

Proxmox 9.2, выпущенный в августе 2026 года, содержал обновление ядра, которое повредило открытые модули ядра NVIDIA для многих домашних пользователей, запускающих локальные LLM. Исправление оказалось в виде исправленного драйвера, который NVIDIA выпустила примерно через неделю. Это повторяющийся паттерн для каждого владельца Proxmox, запускающего GPU для вывода: приходит обновление ядра, драйвер отклоняет новые заголовки, nvidia-smi возвращает “No devices were found”, и Ollama или vLLM не запускаются до переборки.

Лучшие приложения для управления драйверами NVIDIA на Proxmox для рабочих нагрузок локальных LLM превращают этот паттерн из кризиса в рутину. Вот семь инструментов для рабочего стола, которые стоит иметь установленными до следующего обновления ядра.

Что искать в стеке Proxmox NVIDIA

Начните с пути установки драйвера. Установщик .run, поставляемый производителем, работает и его стоит понимать, но для домашней лаборатории вам нужна воспроизводимость пакета. Это означает подписанный .deb из репозитория CUDA от NVIDIA или сценариальный путь, который фиксирует известную хорошую версию драйвера.

Обратите внимание на DKMS. Dynamic Kernel Module Support перестраивает модуль NVIDIA при обновлении ядра. Если вы пропустите DKMS, вы перестраивать вручную при каждом обновлении ядра, и именно там живут ошибки. Подтвердите, что модуль DKMS действительно перестроен после обновления, а не молча упал.

Следите за стороной GPU passthrough. Если GPU передается на VM вместо запуска на хосте, модуль находится внутри VM и Proxmox нужна привязка vfio-pci, чтобы хост не захватывал карту. Нарушенный passthrough часто путают с нарушенным драйвером.

Наконец, планируйте мониторинг и откат. nvidia-smi в цикле сообщает вам, что карта живая; Netdata показывает использование со временем; снимок хоста, сделанный до обновления, означает откат на один клик восстановления Proxmox.

Быстрое сравнение

Приложение Роль Бесплатный план Платный уровень Выдающаяся особенность
Proxmox VE Гипервизор, на котором должна находиться NVIDIA Бесплатно, открытый исходный код Платная подписка на корпоративный репозиторий Снимок перед каждым рискованным обновлением драйвера
NVIDIA driver installer Поставляет CUDA и модули ядра Бесплатно Бесплатно Подписанный .deb и установщик сети, которые пережили обновления ядра
Aprox Proxmox client Получите доступ к консоли Proxmox с телефона или рабочего стола Бесплатно Бесплатно Перезагрузите VM без открытия браузера
Ollama Локальный LLM runner, который потребляет GPU Бесплатно, открытый исходный код Бесплатно Однострочная установка, однострочное извлечение модели
Open WebUI Чат-интерфейс поверх Ollama или vLLM Бесплатно, открытый исходный код Бесплатно Мультимодельный чат, RAG, без облачных зависимостей
vLLM Высокопроизводительный сервер вывода LLM Бесплатно, открытый исходный код Бесплатно Альтернатива Ollama с более высокой пропускной способностью для загруженных настроек
NVIDIA System Management Interface Командная строка nvidia-smi Бесплатно, поставляется с драйвером Бесплатно Инструмент, который вы запускаете в первую очередь, когда что-то ломается
Netdata Живые метрики GPU и системы Бесплатный уровень Платные облачные планы GPU использование, температура и VRAM со временем

1. Proxmox VE

Proxmox VE - это гипервизор в основании стека. Для рабочих нагрузок NVIDIA наиболее важный параметр - это дисциплина снимков: создавайте снимки хоста и VM с GPU перед каждым рискованным изменением драйвера или ядра, чтобы откат был двухкликовой операцией. Расписание резервного копирования веб-интерфейса Proxmox может автоматизировать снимок LXC или VM; сам хост требует отдельного подхода (без состояния установку, снимок ZFS корневого пула или ручную запись флагов установщика).

Где он недостаточен: Proxmox сам по себе не предлагает мастер GPU passthrough первой стороны. Вы настраиваете его через CLI и /etc/pve/qemu-server/<vmid>.conf.

Цены: Бесплатно с репозиторием сообщества. Платная подписка на корпоративный репозиторий начинается с скромной годовой платы за сокет.

Платформы: Bare metal на вычислительном боксе.

Скачать: Proxmox VE

Итог: база. Снимайте перед каждым обновлением драйвера.

2. NVIDIA driver installer

NVIDIA driver installer поставляется либо как подписанный пакет репозитория CUDA, либо как установщик .run. Для домашних лабораторий Proxmox репозиторий CUDA является более надежным путем: добавьте репо, установите nvidia-driver-open (открытые модули ядра) с DKMS, перезагрузитесь, проверьте nvidia-smi. Когда приходит обновление ядра, DKMS перестраивает модуль; когда нет, вы перестраиваете вручную один раз и логируете исправление.

Где он недостаточен: открытые модули ядра все еще более новый путь. Некоторые старые карты требуют проприетарных модулей, и матрица версий стоит чтения перед обновлением.

Цены: Бесплатно.

Платформы: Linux (Debian, Ubuntu и производные, которые использует Proxmox).

Скачать: NVIDIA CUDA repository

Итог: установка репо с DKMS - это настройка, которая пережива обновления ядра в большинстве случаев.

3. Aprox Proxmox client

Aprox - это мобильный клиент для Proxmox. Когда обновление драйвера пошло не так посередине рабочего дня, Aprox позволяет вам перезагрузить пострадавшую VM, откатить на снимок или проверить историю задач без открытия браузера. Он читает тот же API Proxmox, что и веб-интерфейс.

Где он недостаточен: это клиент, а не замена. Глубокая конфигурация все еще проходит через веб-интерфейс.

Цены: Бесплатно.

Платформы: Android; можно использовать с Windows и ChromeOS через Android런тайм.

Скачать: Aptoide · Google Play

Итог: клиент быстрого восстановления для домашней лаборатории, в которую вы не хотите входить на полный рабочий стол.

4. Ollama

Ollama - это самый простой способ запустить локальный LLM на Proxmox GPU. Установите его в VM или контейнер LXC с переданным GPU, извлеките модель командой из одной строки, и Ollama предоставляет локальный API на стандартной форме в стиле OpenAI. Домашние лаборатории, которые начались с Ollama и никогда не уходили, редко сожалеют.

Где он недостаточен: пропускная способность ниже, чем vLLM при параллелизме. Для домашнего чата это не имеет значения; для небольшой команды это может.

Цены: Бесплатно, открытый исходный код.

Платформы: Linux, macOS, Windows.

Скачать: Ollama

Итог: стандартный runner для домашней лаборатории GPU, которая еще не обслуживает vLLM.

5. Open WebUI

Open WebUI - это чат-интерфейс, который находится на вершине Ollama или vLLM. Он обрабатывает мультимодельный чат, RAG против локальных документов, общую историю разговоров и несколько учетных записей пользователей. Запустите его в контейнере на той же VM, что и Ollama, и он появится по URL, который вы можете закладка.

Где он недостаточен: это еще один движущийся компонент. Если вы когда-либо чатились только из терминала, curl против API Ollama работает хорошо.

Цены: Бесплатно, открытый исходный код.

Платформы: Docker (любой хост).

Скачать: Open WebUI

Итог: дружественный интерфейс для домашней настройки LLM.

6. vLLM

vLLM - это высокопроизводительный сервер вывода для случаев, когда домашнее хозяйство или небольшая команда генерирует достаточно токенов в секунду, чтобы Ollama замедлился. Он поддерживает постраничное внимание, пакетные запросы и размещает модели с гораздо более высоким параллелизмом. Настройка более сложна и чувствительна к версии CUDA.

Где он недостаточен: это не опыт “установи и забудь”, как Ollama. Ожидайте чтения примечаний к выпуску и согласования версий CUDA и PyTorch.

Цены: Бесплатно, открытый исходный код.

Платформы: Linux с CUDA.

Скачать: vLLM

Итог: выбор, когда параллелизм важнее простоты настройки.

7. NVIDIA System Management Interface

nvidia-smi - это команда, которую запускает первым каждый пользователь Proxmox-plus-NVIDIA, когда что-то ломается. Она показывает версию драйвера, CUDA runtime, использование GPU, использование VRAM, активные процессы, температуры и мощность. Когда приходит обновление ядра, nvidia-smi - это первое честное чтение того, пережил ли драйвер.

Где она недостаточна: это CLI. Есть графический цикл nvidia-smi -l 1, который вы можете оставить в панели tmux, но это не панель мониторинга.

Цены: Бесплатно, поставляется с драйвером.

Платформы: Linux, Windows (через драйвер NVIDIA).

Скачать: В комплекте с установкой драйвера NVIDIA выше.

Итог: первый инструмент, который вы должны запустить после каждого изменения ядра или драйвера.

8. Netdata

Netdata автоматически подбирает сборщик NVIDIA при установке драйвера. Он отображает использование GPU, VRAM, мощность и температуру с детализацией на уровне секунды в браузере. Исторически именно так вы замечаете тепловую регулировку, которую не сообщает пробный прогон.

Где он недостаточен: долгое хранение на бесплатном уровне ограничено. Сохраните исторические метрики в Prometheus, если история GPU за год имеет значение.

Цены: Бесплатный уровень для небольшого количества узлов. Платные облачные планы добавляют хранение.

Платформы: Linux (агент), любой браузер (панель мониторинга).

Скачать: Netdata

Итог: самый быстрый способ заметить неправильное поведение GPU со временем.

Как выбрать

Каждая домашняя лаборатория GPU должна начинаться с Proxmox VE (снимок перед изменениями драйвера), репозитория NVIDIA CUDA с DKMS и nvidia-smi как инструмента первой проверки. Добавьте Ollama плюс Open WebUI для дружественной настройки LLM, или vLLM, если имеет значение пропускная способность. Установите Aprox для управления со стороны телефона и Netdata для непрерывной видимости GPU. Когда приходит обновление ядра, сначала снимайте, второе обновление, третье nvidia-smi, и четвертое проверьте панель GPU Netdata. Если что-то из этого не удается, клиент Aprox быстрее, чем открывать браузер для отката.

FAQ

Почему Proxmox 9.2 сломал мои локальные LLM?

Обновление ядра было впереди поддержки драйверов NVIDIA для него. NVIDIA выпустила исправленный драйвер примерно через неделю; установка этого драйвера, затем запуск dkms status и перезагрузка восстановили nvidia-smi и Ollama.

Должен ли я использовать открытые или проприетарные модули NVIDIA на Proxmox?

Для недавних карт Ampere и более новых открытые модули ядра - это рекомендуемый путь в 2026 году и то, что NVIDIA поддерживает вперед. Старые карты Turing и Pascal все еще полагаются на проприетарные модули.

Нужен ли мне GPU passthrough для Ollama на Proxmox?

Если GPU находится на вычислительном боксе и вы запускаете Ollama на хосте, нет. Если вы запускаете Ollama внутри VM, да. Контейнеры LXC могут делиться GPU хоста без passthrough с правильными правилами cgroup и udev.

Какой лучший локальный LLM runner на Proxmox?

Ollama для простоты настройки, vLLM для параллелизма. Оба потребляют драйвер NVIDIA, установленный на гостевой машине.

Как мне мониторить температуру GPU со временем на Proxmox?

Установите Netdata на гостевую машину, которая владеет GPU. Она автоматически подбирает метрики NVIDIA. Для долгого хранения отправьте метрики в Prometheus и просмотрите их в Grafana.