Интеллект дешевеет: бизнес не готов платить за самые мощные модели, когда есть дешевые open-source или чуть менее мощная модель
Согласно данным Ramp и Financial Times, клиенты Anthropic в США используют Opus 4.8, чем fable 5.
Fable 5 через два месяца после релиза занимает около 11 % затрат клиентов и ~6 % токенов.
А более дешёвые модели, например, Opus 5 обгоняют Fable 5 по расходам. Клиенты выбирают то, что достаточно хорошо и заметно дешевле.
Общий спрос на токены продолжает расти.
На Vercel доля моделей с открытыми весами за 2 месяца выросла с 28 % до 62 %.
На OpenRouter китайские модели: DeepSeek, Qwen, GLM и др. у американских пользователей поднялись с4,5 % в начале 2025-го до 50–60 % в этом году.
При этом инференс стоит одинаково - те же GPU и электричество, независимо от того, открытые веса или закрытые. Токен не знает, open-source он или нет.
Ранее мы писали, кто заработает на новом рынке вычислительных мощностей? Тут разбор.
Параллельно растёт чувствительность к цене:
1. 62 % организаций столкнулись с неожиданными расходами на ИИ, которые изменили бизнес-решение;
2. у 40 % это дошло до совета директоров;
3. 33 % ввели экстренные заморозки бюджетов;
4. 25 % отложили или отменили ИИ-проекты (данные Mavvrik/Benchmarkit).
В выигрыше остаются те, у кого инфраструктура: GPU, облака, инференс-платформы и разработчики приложений.

6
2August 24, 2026 1.8K 37