ProQuality Community: post #1827 — TG.ME

#ProQuality_news

🤖 Agentic Testing: Место ИИ-агентов в пирамиде тестирования (опыт Slack)

Команда инженеров Slack опубликовала статью о том, как они прогнали более 200 E2E-тестов с помощью автономных ИИ-агентов (на базе моделей Claude). Цель — понять, готовы ли агенты заменить классические автотесты. Спойлер: не готовы, но у них есть своя суперсила.

🎯 Главное отличие: Путь vs. Цель
Традиционные тесты жестко проверяют маршрут (кликни сюда -> введи текст -> проверь ассерт).
ИИ-агенты проверяют цель (например, «отправь сообщение в тред и убедись, что оно там»). Агент сам анализирует DOM, адаптируется к изменениям верстки и каждый раз может находить разные пути для выполнения задачи.

📊 Что показал эксперимент Slack?
Инженеры сравнили автономных агентов (через Playwright MCP и CLI) и детерминированные тесты, код которых был просто сгенерирован ИИ.

1️⃣ Надежность: На сложных UI-сценариях связка «Агент + Playwright MCP» показала лучшую стабильность (от 0 до 12% падений). А вот статичные автотесты, сгенерированные ИИ заранее, с треском провалились — 48% падений из-за малейших изменений стейта приложения.
2️⃣ Скорость и Цена (шок-контент): Агенты работают медленно (от 5 до 11 минут на тест). Но главное — это безумно дорого! Из-за того, что агенту постоянно нужно «скармливать» слепки DOM и историю шагов, один прогон агента стоил Slack от $15 до $30! 🤯

🔺 Новый слой пирамиды тестирования
Slack делает однозначный вывод: ИИ-агенты пока не могут (и не должны) заменять быстрые и дешевые E2E-тесты в CI/CD пайплайнах.

Вместо этого агенты формируют новый, четвертый слой на самой вершине пирамиды тестирования. Их идеальный юзкейс сегодня:
• Exploratory Testing (исследовательское тестирование) сложных сценариев
• Автоматический дебаг плавающих (flaky) багов
• Воспроизведение хитрых дефектов прямо с продакшена

🔗 Agentic Testing: Where Agents Fit in the E2E Testing Stack
💬 Как вам стоимость в $15–30 за один проход автотеста? И как вам идея добавить четвертый уровень в классическую пирамиду тестирования? Делитесь мыслями в комментариях! 👇
slack.engineering
Agentic Testing: Where Agents Fit in the E2E Testing Stack
Abstract Agent-driven end-to-end (E2E) tests add a new exploratory layer to testing, but should they replace traditional deterministic tests? We ran more than 200 agentic E2E workflows using the Playwright MCP, Playwright CLI, and agent-generated Playwright…
👍3❤2
August 10, 2026 318 5