Научный проект новой архитектуры языковой модели, которая наращивает «глубину рассуждений» по мере обработки текста.
Recurrent Looped Transformer переносит промежуточные вычисления через каждый обрабатываемый и генерируемый токен: чем длиннее последовательность, тем длиннее путь вычислений модели, при этом объём вычислений на один токен не растёт. Идея опирается на совместное проектирование модели, оборудования и алгоритма обучения с подкреплением. Это страница исследования со ссылкой на статью, а не готовый к использованию продукт.
Описание автора:Official Project Page for Recurrent Looped Transformer (RLT)
HTML★ 823создан 12 сентября 2026форков 81Apache-2.0