Модель генерирует несколько вариантов решения, сама проверяет их и выбирает наиболее удачный.
Метод уже показал результат: DeepSeek V4 Flash поднялся в Terminal-Bench 2.1 с 79% до 88%, обойдя Claude Fable 5.
А главное — подход примерно в 11 раз дешевле Fable 5 на одну задачу. Фреймворк полностью open-source и бесплатный.
Прокачиваем своих агентов — тут.

