Prime Agent выпустили технический отчёт "Prime Agent: A… — Машиннное обучение | Наука о данных Библиотека — TG.ME

🔥 Prime Agent выпустили технический отчёт

"Prime Agent: A Self-Improving RLM Harness"

В работе подробнее разобрана архитектура Prime Agent и его роль как harness для долгих agentic-оценок.

Один из самых интересных экспериментов - Factorio:

- 7 дней непрерывной траектории на Sonnet 5
- 23,4 млн output tokens
- завершено 24 из 196 технологий
- ещё 71% прогресса до следующей технологии
- 633 запущенных subagents
- максимум 7 агентов работали одновременно

Отчёт:
https://arxiv.org/abs/2608.23552
🔥3
August 26, 2026 989 22