Anthropic обновила Claude до версии Fable 5.1, а параллельно представила более закрытую модель Mythos 5.1.
Главный фокус апдейта - не просто более умные ответы, а автономная работа модели.
• заметно улучшили работу с кодом и управлением компьютером;
• модель способна самостоятельно выполнять сложные задачи часами;
• в некоторых сценариях расход токенов снизился на 30–60%;
• чтение кэша стало дешевле на 75% - $0.25 за 1 млн токенов;
• стандартные нагрузки подешевели примерно на 25%, агентские - до 45%;
• количество ошибочных safety-отказов сократилось на 60%;
• улучшились глубокий ресерч и работа с многоэтапными задачами.
По сути, Claude постепенно превращается из чат-бота в полноценного агента.
Теперь сценарий может выглядеть примерно так:
Получить задачу → разобраться → найти проблему → внести изменения → проверить результат → продолжить работу.
При этом для простых запросов преимущества новой версии будут не такими заметными - её сильная сторона именно длинные и сложные задачи.
• Terminal-Bench: 42% → 55.8%
• Результаты в ресерче: ~25% → 52.6%
• Кэш: −75% по стоимости
• Обычные сценарии: примерно −25%
• Агентские задачи: до −45%
• Ложные safety-отказы: −60%
Цена осталась прежней – $10/$50 за миллион токенов, зато cache reads подешевели на 75%, до $0,25 за миллион. По оценке Anthropic, это может снизить расходы примерно на 25% в обычных сценариях и до 45% в агентных.
Ваше мнение, какая модель самая оптимальная сейчас?

