Не начинайте с самой дорогой. Выберите стартовую модель по нагрузке:
⚡ Qwen Flash — короткие ответы и массовые задачи: 4,22 ₽ за 1 млн входных и 33,72 ₽ за 1 млн выходных токенов.
◼️ GPT-5.6 Luna — повседневные запросы и автоматизация с балансом цены и возможностей: 28,61 ₽ / 171,62 ₽.
◆ GPT-5.6 Terra — сложный анализ, код и агентные сценарии с инструментами: 263,16 ₽ / 1 578,86 ₽.
Все три доступны через тот же ключ и
POST /v1/responses. Меняется только поле model.Это стартовая схема, а не универсальный рейтинг: прогоните 20–50 своих типовых запросов и сравните качество, задержку и стоимость. Перед запуском всегда сверяйте
GET /v1/models и GET /v1/prices — каталог и цены обновляются.