Alibaba тихо уделала Opus по кодингу Пока все спорили, кто круче… — AIнновацИИ — TG.ME

Alibaba тихо уделала Opus по кодингу

Пока все спорили, кто круче — GPT или Claude, китайцы выкатили Qwen3.8-27B и молча обошли Opus 4.6 Max по кодовым бенчмаркам. Без пресс-релизов на весь интернет, без слайдов с ракетами вверх. Просто цифры.

SWE-bench Pro: 61,7 против 53,4 у Opus. Terminal Bench 2.1: 78,2 против 73,0. Разрыв не космический, но стабильный — и это модель, которую можно гонять локально на Mac.

Вот тут и начинается самое интересное. Веса открыты под Apache-2.0. Значит бери, форкай, встраивай в свой продукт, зарабатывай — никто слова не скажет. Плюс модель жуёт текст, картинки и видео разом, так что это не узкий кодер-инструмент, а универсальный комбайн.

Опять всплывает старый вопрос: за что вообще платить $200 в месяц за подписку, если открытая модель почти догнала топ и отдаётся бесплатно? Ответ обычно один — за стабильность и поддержку. Но с каждым релизом такого уровня этот аргумент звучит всё слабее.

Запускал уже кто-то локально? Делитесь впечатлениями, интересно сравнить с реальными задачами, а не только с бенчмарками.
August 15, 2026 23