Исследовательский эксперимент: можно ли заставить обычную языковую модель отвечать на вопросы с вариантами так же точно, как через генерацию JSON.
Mini-Jev проверяет, способна ли замороженная модель Qwen3-4B, отвечая на вопрос как на тест с вариантами (по букве ответа), давать такую же точность, как при генерации структурированного JSON-объекта под жёсткой грамматикой. Эксперимент заранее зарегистрирован, а все цифры пересчитываются из сохранённых логов запусков. По результатам разница в точности между двумя подходами статистически незначима.
Описание автора:mini-Jev: what a Jev-style typed-decision interface looks like on a frozen Qwen3-4B — read the option letter's logits instead of generating JSON. Preregistered experiment, results, teaching bench.