gufo-org /gufo
Движок для локального запуска больших языковых моделей на компьютерах с процессорами AMD Strix Halo (Ryzen AI MAX+ 395).
Gufo — специализированный инференс-движок, заточенный под аппаратную платформу AMD Strix Halo с общей памятью до 128 ГБ, поддерживает модели семейства Qwen и DeepSeek с ускоренными режимами генерации. В репозитории опубликованы измеренные показатели скорости обработки и генерации текста для нескольких моделей и настроек. Предназначен для тех, кто хочет запускать крупные модели локально на этом железе без облачных сервисов.
Описание автора: Strix Halo inference engine. Qwen Flash Next Q4_K_XL: 1,628.52pp, 59.41tg single user, 157.22 tok/s 8 users; Qwen27B Q4_K_XL: 656.33pp, 70.56 tok/s tg single user with DFlash2
Сколько звёзд прибавилось
- Сутки ≈ +159 219-е место
- Неделя ≈ +159 1575-е место
- Месяц ≈ +160 вне рейтинга
- 3 месяца ≈ +160 вне рейтинга
Без значка — точная разница ежедневных снимков счётчика GitHub, со значком ≈ — оценка по архиву событий.
Точный счётчик GitHub: +52 звезды с 21:20 24 сентября по 08:21 25 сентября.
Прирост по дням за 3 месяца
Оценка по выборке GH Archive. Бледные столбцы — дни, история за которые ещё загружается.