open-models

Локальная Qwen3.8-27B вышла с контекстом 262K

Promtime

open-models

Alibaba опубликовала веса Qwen3.8-27B на Hugging Face под лицензией Apache 2.0: нативное окно контекста модели составляет 262 тысячи токенов и расширяется до 1 миллиона через YaRN. О релизе сообщается в посте в Threads, где модель названа пригодной для локального запуска на собственном оборудовании.

Коротко

  • Модель заявлена как плотная и нативно мультимодальная, её веса выложены в открытый доступ под лицензией Apache 2.0, что даёт возможность развернуть её на собственном оборудовании и дообучать под свои задачи без ограничений на коммерческое применение.
  • Нативное окно контекста заявлено на уровне 262 тысяч токенов, через YaRN оно растягивается до 1 миллиона: обе цифры приведены в публикации о выходе весов Qwen3.8-27B на Hugging Face.
  • Вместе с локальной версией Alibaba выпустила Qwen3.8-2.4T-A95B, модель класса Max, а в посте о релизе утверждается, что 27-миллиардная Qwen3.8-27B идёт вровень с Opus 4.6 на бенчмарках.

Почему это важно Открытые веса модели на 27 млрд параметров с окном в сотни тысяч токенов переносят конкуренцию из плоскости доступа к API в плоскость того, что разворачивается на собственной инфраструктуре, где стоимость определяется железом и загрузкой. Заявление о паритете с Opus 4.6 пока остаётся утверждением из релиза, и вес ему придадут независимые прогоны на публичных наборах задач. Для команд, которым важен контроль над данными и предсказуемая стоимость инференса, лицензия Apache 2.0 вероятно значит не меньше, чем цифры бенчмарков.

Веса Qwen3.8-27B выложены на Hugging Face под лицензией Apache 2.0. Лицензия допускает дообучение, распространение производных версий и коммерческое использование без отдельного соглашения с правообладателем. Модель распространяется файлами весов, доступными для загрузки, а не через закрытый сервис с доступом по API.

Qwen3.8-27B описана как плотная и нативно мультимодальная модель, рассчитанная на локальный запуск без обращения к облачным сервисам. Нативное окно контекста заявлено на уровне 262 тысяч токенов, расширение до 1 миллиона выполняется методом YaRN поверх этого окна. В посте о релизе утверждается, что при 27 млрд параметров модель идёт вровень с Opus 4.6 на бенчмарках.

Открытый релиз Alibaba анонсировала на прошлой неделе. Вместе с локальной версией вышла Qwen3.8-2.4T-A95B, модель класса Max. Обе модели относятся к поколению Qwen3.8 и вышли одновременно, при этом характеристики контекста и публикация весов под Apache 2.0 заявлены именно для 27-миллиардной версии.

Что дальше Ближайшая проверка релиза ложится на локальные прогоны: в публикации о выходе весов говорится о переходе к тестам на своей машине. Открытым остаётся вопрос, как заявленный паритет с Opus 4.6 выглядит на независимых замерах и насколько устойчиво держится окно в 1 миллион токенов, получаемое через YaRN на длинных задачах. Сроки публикации таких результатов пока не называются.

Комментарии

Пока никто не написал. Будьте первым.

Присоединяйтесь к разговору

Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.

Из Google мы используем только имя и аватар. Почту не сохраняем.