Мне попался ролик про бихевиоризм, в итоге на фоне прослушал ещё… — Тёмные мысли Техношамана — TG.ME

Мне попался ролик про бихевиоризм, в итоге на фоне прослушал ещё несколько видео на эту тему.
Классическая схема оперантного научения по Б. Ф. Скиннеру: Стимул - Реакция - Подкрепление.

Внешний раздражитель напрямую запускает автоматический ответ.
При положительных последствиях реакция закрепляется, и вероятность её повторения растет.

То есть это буквально алгоритм классического обучения в проекте Сумобокс.
Проблема в том, что ранние бихевиористы (начало 20 века) именно так и представляли всё поведение человека.

В 1957 году Б. Ф. Скиннер опубликовал книгу "Вербальное поведение" (Verbal Behavior), где попытался объяснить усвоение языка ребёнком исключительно через схему (Стимул - Реакция - Подкрепление).

Лингвист Ноам Хомский в своей критике наглядно показал, что за всё детство ребенок физически не успел бы получить столько подкреплений, чтобы выучить все конструкции языка. Мозг явно работает сложнее.
Видимо в этот момент классический бихевиоризм сломался и стал терять популярность.

Вот мои представления о мозге и обучении на данный момент.

1. ( Стимул - Реакция - Подкрепление ) - самый примитивный уровень. Его можно обнаружить у простейших организмов.
Аналогичные механизмы реакции на среду возможно есть и в мире растений и грибов.

2. ( Стимул - Моделирование - Ответ ) - в ответ на стимул в голове запускается симуляция разнооборазных вариантов действий на основе прошлого опыта и выбирается лучший.
В шахматных программах алгоритм просчитывает последствия на несколько ходов вперёд и выбирает тот, который ведет к наиболее выгодной позиции.
В Сумобоксе это тоже можно реализовать. Боксёр в своей голове запускает модель сумобокса, прогоняет разные варианты ответа (возможно из заготовленных), выбирая лучший.

3. ( Создание моделей ) У агента нет вшитой модели мира, он строит её сам, наблюдая за окружением, а затем использует для симуляции вариантов (как в пункте 2).
Моделей может быть много (бытовая, социальная, научная).
Эти внутренние модели постоянно редактируются при поступлении новых данных и могут становиться невероятно абстрактными (вплоть до математики, философии или религии).

Напомню, что это лишь моя текущая ментальная модель, которая может быть отредактированна.
🔥23❤6👍6👀2⚡1🕊1🗿1
August 18, 2026 1.3K 12 1