Модель Qwen3.8-Flash-Next, основанная на архитектуре, которая станет основой для Qwen4, была успешно запущена с полным checkpoint на графическом процессоре RTX 4090. Пиковое потребление VRAM составило 5,95 ГБ, что позволяет использовать модель на системах с ограниченными ресурсами.
Согласно опубликованным результатам, Qwen3.8-Flash-Next демонстрирует конкурентоспособность с закрытыми frontier-моделями в таких задачах, как программирование и работа с агентами. Модель использует полный checkpoint в формате bf16, что позволяет генерировать обычные токены без необходимости в 4-битной квантизации и дистилляции.
Данная модель представляет собой значительный шаг вперед в области открытых ИИ-технологий, предлагая пользователям возможность работы с высокопроизводительными инструментами. Конкуренция с закрытыми моделями может способствовать ускорению развития технологий и расширению возможностей для исследователей и разработчиков.