ИИ дешевеет — но у самых красивых цен появился мелкий шрифт Цена… — ForgetMe | Нейросети — TG.ME

📛 ИИ дешевеет — но у самых красивых цен появился мелкий шрифт

Цена одного и того же уровня «интеллекта» продолжает лететь вниз. По подсчётам OECD, скорректированный на качество индекс цен языковых моделей упал почти на 80% с января 2024-го по апрель 2026-го.

Но свежие примеры показывают: это уже не простая гонка «кто даст дешевле». Провайдеры всё чаще субсидируют токены данными пользователей, временными скидками и ценами отдельных маршрутов.

Muse Spark 1.2 — самый наглядный пример. Обычный API-тариф Meta стоит $1.25/$4.25 за миллион входных и выходных токенов. Но в режиме Contributor цена падает до $0.10/$0.20, а кэшированный вход — до $0.002.

То есть на 92–95% дешевле. Но это не снижение базового прайса: в Contributor пользователь разрешает Meta использовать запросы и ответы для обучения будущих моделей. В Standard такого разрешения нет. Получается почти бесплатный инференс — если вы готовы доплачивать данными. Условия Meta

DeepSeek пока остаётся экстремально дешёвым: V4 Flash стоит $0.14/$0.28, а кэшированный вход — всего $0.0028 за миллион токенов.

Однако компания уже официально предупредила, что в ближайшее время общая стоимость API заметно вырастет. Новые ставки и дату DeepSeek пока не назвала. Это хороший контрпример к идее вечного удешевления: сверхнизкая цена может оказаться этапом захвата рынка, а не постоянным тарифом.

С GLM 5.2 ситуация третья. Официальный прайс Z.ai не изменился — $1.40/$4.40. Зато на OpenRouter маршруты Novita и StreamLake сейчас отдают модель примерно за $0.42/$1.32, то есть со скидкой около 70%. Это акция конкретных хостингов без объявленного срока, а не постоянное снижение тарифа Z.ai. Актуальная карточка

Если не хочется разбираться с зарубежной оплатой, на ForgetAPI эти модели сейчас стоят:

— Muse Spark 1.2 — $0.60/$2.00 (примерно 49,30/164,33 ₽);
— DeepSeek V4 Flash — $0.078/$0.156 (примерно 6,41/12,82 ₽);
— GLM 5.2 — $0.80/$2.80 (примерно 65,73/230,07 ₽).

Цены указаны за миллион входных/выходных токенов. Это не всегда абсолютный минимум рынка — Contributor-тариф Muse и временная акция GLM на OpenRouter дешевле. Зато здесь один OpenAI-совместимый ключ, оплата российской картой или криптой и работа без VPN.


В итоге модели действительно дешевеют, но цена за миллион токенов всё меньше похожа на честный ценник и всё больше — на авиабилет: зависит от маршрута, времени, кэша и того, чем ещё вы платите.

Поэтому для реальных задач важнее смотреть не только на $/1M токенов, а на стоимость законченного результата. В одном исследовании более дешёвая по прайсу reasoning-модель оказывалась дороже по фактической задаче в 21,8% сравнений — из-за длинных рассуждений и лишних проходов.

🤑 ForgetMe | Boosty

💻 API нейросетей на 30-40% дешевле официалов

Приобрести подписку на любые сервисы
⏩ @forgetshop_bot

#нейросети #новости
❤9👍6🔥3🤔1
August 10, 2026 4.1K 13 22