Готовый Docker-рецепт для запуска большой ИИ-модели DeepSeek v4 Flash на одном сервере NVIDIA DGX Spark.
Проект — это скрипт-лаунчер, который разворачивает языковую модель DeepSeek V4 Flash на одном устройстве DGX Spark вместо двух, используя сжатую версию модели и ускоренную технику предсказания токенов. Настроен на большой контекст (сотни тысяч токенов) и оптимизирован по скорости и использованию памяти. Предназначен для инженеров, которые хотят запускать крупные ИИ-модели локально на одном сервере.
Описание автора:DeepSeek v4 Flash EXL3 on one DGX Spark