Рецепт и код для запуска большой ИИ-модели DeepSeek V4.1 Flash на обычном Mac mini с 16 ГБ памяти.
Проект показывает, как запустить оригинальные веса модели DeepSeek V4.1 Flash объёмом 475 гигабайт на Mac mini M1 с 16 ГБ памяти, читая нужные части модели напрямую с SSD-накопителя вместо загрузки всего в оперативную память. Скорость — около 23 секунд на одно слово ответа, без урезания или упрощения модели. Репозиторий содержит инструкции по воспроизведению эксперимента, замеры скорости и демонстрационное видео.
Описание автора:Run original DeepSeek V4.1 Flash FP4/FP8 weights on a 16 GB M1 Mac mini with bounded SSD streaming in MLX. Recipe, benchmarks, and demo.
Python★ 88создан 11 сентября 2026форков 4Apache-2.0