Исследовательский проект: способ заставить пять открытых моделей Qwen решать сложные задачи программирования не хуже топовой модели Claude.
Метод координирует несколько экземпляров одной модели через общий файл с планом и заметками, без дополнительного обучения, деля задачу на части. На тесте LiveCodeBench Hard такая оркестрация подняла точность открытой модели Qwen3.8-27B с 69,2% до 92,4%, что превзошло результат более дорогой модели Claude. В репозитории есть код для запуска эксперимента с разными моделями через API.
Описание автора:GVS5H: Five Qwen3.8-27B Models Match Claude Fable 5 on LiveCodeBench Hard | Fable 5 Level Coding for a Fifth the Price - or on a Single GPU