Локальный движок для запуска больших языковых моделей на компьютерах Apple с чипами M-серии, оптимизированный под скорость.
Splash — сервер инференса для macOS на процессорах Apple Silicon, который раздаёт модели агентам-кодировщикам и любым клиентам, совместимым с API OpenAI или Anthropic. По данным авторов, на Mac с 48 ГБ памяти и чипом M5 Pro модель Qwen3.8-27B работает вдвое быстрее ближайшего конкурента. Настройка минимальна: движок сам подбирает вычислительные ядра и распределение памяти под конкретную модель.
Описание автора:A local inference engine for Apple silicon, built around the model.
Python★ 23создан 18 сентября 2026форков 1Apache-2.0