Qwen4: Alibaba выпустили первую модель на новой архитектуре Состоялся… — AI for Devs — TG.ME

⚡️ Qwen4: Alibaba выпустили первую модель на новой архитектуре

Состоялся релиз Qwen3.8-Flash-Next на 125 млрд параметров. Alibaba переработали механизм работы с длинным контекстом и добавили отдельную память на 51 млрд параметров для частых сочетаний текста и кода.

Это пока не полноценная Qwen4: модель выпустили, чтобы сообщество научилось работать с новой архитектурой до появления всего семейства.

На DeepSWE новинка набрала 58,7% против 42,2% у Qwen3.8-27B и 54,4% у DeepSeek V4 Flash. Но до Kimi K3 с открытыми весами не дотянула, у последней 67,5%.


Веса уже доступны бесплатно, но для локального запуска потребуется больше 80 ГБ памяти.

API-версия скоро появится в QwenCloud по цене $0,16/$0,47 за миллион токенов.

@ai_for_devs
1🔥36👍24❤7🤯1
August 27, 2026 7K 53