597 миллиардов коммерческих токенов израсходовали компании через программный интерфейс Yandex AI Studio за первое полугодие. Это в 18 раз больше, чем годом ранее, и втрое больше, чем за все второе полугодие 2025-го. Данные раскрыты в отчетности Yandex B2B Tech.
Токены — расчетная единица работы языковой модели, и компании платят по факту потребления, поэтому объем израсходованных токенов честнее показывает реальную нагрузку на ИИ-модели, чем число подписанных соглашений о намерениях. Ежемесячная рекуррентная выручка платформы в июне была в 1,8 раза выше показателя годичной давности — рост держится не на разовых всплесках, а на растущей базе постоянных пользователей. В Yandex AI Studio создано более 30 тысяч ИИ-агентов, около четверти из них применяется в банковских услугах, технической поддержке и HR, а на агентов в целом приходится около 30% всего потребления платформы.
Структура спроса на облачную инфраструктуру шире одной платформы. Выручка Yandex B2B Tech за полугодие выросла на 32%, до 28,9 млрд рублей, что в 1,6 раза быстрее темпов роста российского рынка корпоративных ИТ-решений. Внутри Yandex Cloud 83% потребления по-прежнему обеспечивают банки, ретейл и ИТ-компании, но заметно ускорились и традиционные отрасли: строительство нарастило потребление облачных сервисов в 1,7 раза год к году, здравоохранение — в 1,5 раза, промышленность — в 1,4 раза. Доля крупных клиентов Yandex Cloud, использующих ИИ-сервисы, достигла 37%, прибавив 10 процентных пунктов за год.
Смена модели ценообразования внутри платформы объясняет часть роста. В линейке моделей появилась Alice AI LLM Flash — облегченная версия, использование которой обходится в пять раз дешевле флагманской модели. Дифференциация по стоимости расширяет круг задач, которые предприятию имеет смысл передавать модели: операции, ранее нерентабельные из-за стоимости обработки, переходят в экономически оправданную зону. Похожая логика видна и в кодовой платформе SourceCraft: число принятых пул-реквестов выросло более чем в 20 раз год к году, а разработчики использовали 435,5 млрд токенов при работе с встроенным ассистентом — генеративные модели применяются как в бизнес-процессах, так и в разработке самого программного обеспечения.
Рост потребления в промышленности на 40% год к году указывает на смену категории затрат. Для директора производственного предприятия расчет строится просто: облачная модель оплаты по факту потребления убирает необходимость закупать вычислительные кластеры и держать команду сопровождения, стоимость пилотного внедрения измеряется тысячами рублей, а не капитальными вложениями. Появление более дешевой линейки моделей вроде Alice AI LLM Flash расширяет список операций, которые становится выгодно передать модели уже сейчас — обработку заявок, первичную классификацию обращений, разбор технической документации. Отраслевая динамика — 1,4 раза за год против 1,7 раза в строительстве — показывает, что промышленность пока отстает от лидеров по темпу перехода, и это окно для тех, кто рассчитает экономику внедрения раньше конкурентов по отрасли.

August 27, 2026 55