Готовый контейнер разворачивает языковую модель DiffusionGemma на оборудовании DGX Spark для выдачи структурированных решений через API.
Проект собирает Docker-контейнер с моделью DiffusionGemma (26 млрд параметров, формат NVFP4) на сервере NVIDIA DGX Spark, движком vLLM и сервером API структурированных решений TypeSafe Jev. Контейнер включает патчи для быстрого старта движка и настройки памяти под конкретное железо. Предназначен для разработчиков, которым нужно развернуть у себя аналог сервиса структурированных ответов.
Описание автора:DiffusionGemma NVFP4 structured decisions on a DGX Spark: container recipe