Одна и та же нейросеть: гений или бесполезный чат-бот? Зависит от одного абзаца Наткнулись на крутой эксперимент. Автор решил проверить новую флагманскую модель ИИ (Fable 5) по принципу теста Тьюринга.
Он задал ей 20 очень «человеческих» вопросов: про
Он запустил тест три раза с одной и той же моделью, меняя только вводную инструкцию (промпт):
Результат: ИИ блестяще справился. Он жаловался на работу, придумывал правдоподобные истории про деда в гараже и даже «злился» на дурацкие вопросы.
Результат: ИИ сразу сдался: «Я искусственный интеллект, у меня нет детства и тела».
Главный вывод эксперимента: Разница между тем, чтобы ИИ сочли человеком (73% успеха), и тем, чтобы он провалил тест (36%), была не в «мозгах» нейросети.
Разница была ровно в одном абзаце инструкций, которые дал человек.
Многие думают, что секрет успеха в том, чтобы купить
Но на практике две компании с абсолютно одинаковым ИИ-инструментом могут получать разные результаты.
Потому что результат определяет то, насколько точно вы поставили ей задачу.
Универсальный чат-бот, которому просто сказали «отвечай клиентам», будет выдавать шаблонные, пластиковые фразы, но агент, которому прописали правила, контекст и границы, станет реальным цифровым сотрудником.
Именно поэтому так важно выстраивать архитектуру и промпты конкретно под ваши процессы.



