На Cerebras она, скорее всего, будет работать на скорости 2000+ токенов в секунду. Разрыв огромный.
Для сравнения, ChatGPT обычно выдаёт около 50–100 токенов в секунду, а быстрый режим Codex — примерно 150–200.
То есть Qwen на Cerebras потенциально сможет работать примерно в 10 раз быстрее быстрого режима Codex..

