Цена одного и того же уровня «интеллекта» продолжает лететь вниз. По подсчётам OECD, скорректированный на качество индекс цен языковых моделей упал почти на 80% с января 2024-го по апрель 2026-го.
Но свежие примеры показывают: это уже не простая гонка «кто даст дешевле». Провайдеры всё чаще субсидируют токены данными пользователей, временными скидками и ценами отдельных маршрутов.
Muse Spark 1.2 — самый наглядный пример. Обычный API-тариф Meta стоит $1.25/$4.25 за миллион входных и выходных токенов. Но в режиме Contributor цена падает до $0.10/$0.20, а кэшированный вход — до $0.002.
То есть на 92–95% дешевле. Но это не снижение базового прайса: в Contributor пользователь разрешает Meta использовать запросы и ответы для обучения будущих моделей. В Standard такого разрешения нет. Получается почти бесплатный инференс — если вы готовы доплачивать данными. Условия Meta
DeepSeek пока остаётся экстремально дешёвым: V4 Flash стоит $0.14/$0.28, а кэшированный вход — всего $0.0028 за миллион токенов.
Однако компания уже официально предупредила, что в ближайшее время общая стоимость API заметно вырастет. Новые ставки и дату DeepSeek пока не назвала. Это хороший контрпример к идее вечного удешевления: сверхнизкая цена может оказаться этапом захвата рынка, а не постоянным тарифом.
С GLM 5.2 ситуация третья. Официальный прайс Z.ai не изменился — $1.40/$4.40. Зато на OpenRouter маршруты Novita и StreamLake сейчас отдают модель примерно за $0.42/$1.32, то есть со скидкой около 70%. Это акция конкретных хостингов без объявленного срока, а не постоянное снижение тарифа Z.ai. Актуальная карточка
Если не хочется разбираться с зарубежной оплатой, на ForgetAPI эти модели сейчас стоят:
— Muse Spark 1.2 — $0.60/$2.00 (примерно 49,30/164,33 ₽);
— DeepSeek V4 Flash — $0.078/$0.156 (примерно 6,41/12,82 ₽);
— GLM 5.2 — $0.80/$2.80 (примерно 65,73/230,07 ₽).
Цены указаны за миллион входных/выходных токенов. Это не всегда абсолютный минимум рынка — Contributor-тариф Muse и временная акция GLM на OpenRouter дешевле. Зато здесь один OpenAI-совместимый ключ, оплата российской картой или криптой и работа без VPN.
В итоге модели действительно дешевеют, но цена за миллион токенов всё меньше похожа на честный ценник и всё больше — на авиабилет: зависит от маршрута, времени, кэша и того, чем ещё вы платите.
Поэтому для реальных задач важнее смотреть не только на $/1M токенов, а на стоимость законченного результата. В одном исследовании более дешёвая по прайсу reasoning-модель оказывалась дороже по фактической задаче в 21,8% сравнений — из-за длинных рассуждений и лишних проходов.
ForgetMe | Boosty
API нейросетей на 30-40% дешевле официаловПриобрести подписку на любые сервисы
#нейросети #новости




