Ещё одна локальная версия модели Laya для Apple Silicon, работает через фреймворк MLX без PyTorch и облачных сервисов.
В отличие от версии на Core ML, этот вариант использует нативный runtime MLX и показывает похожие результаты — единицы или десятки миллисекунд на одно короткое решение на Mac с чипом M3 Max. Автор публикует подробные замеры скорости и стабильности на примере игры в змейку, где каждое движение рассчитывает модель. Всё вычисляется локально на устройстве, без обращения к интернету.
Описание автора:Native MLX runtime for Laya typed decision models — 7–14 ms short decisions on M3 Max. No text generation, PyTorch, or cloud API.
Python★ 136создан 19 сентября 2026форков 2Apache-2.0