Инструкция и настройки для запуска большой AI-модели DeepSeek на нескольких серверах NVIDIA DGX Sparks.
Проект показывает, как развернуть языковую модель DeepSeek-V4.1-Flash на кластере из 3-4 серверов NVIDIA DGX Sparks, объединённых быстрой сетью. В README приведены подробные замеры скорости работы (токенов в секунду) при разной нагрузке и настройках контекста. Подходит компаниям и разработчикам, у которых уже есть такое дорогостоящее оборудование и нужен готовый рецепт настройки, а не сама модель.
Описание автора:DeepSeek-V4.1-Flash on 3-4x NVIDIA DGX Sparks
Python★ 121создан 11 сентября 2026форков 19AGPL-3.0