Чат-боты с ИИ лучше проявляются себя в творчестве, чем средний человек — теперь официально

Недавнее исследование показывает, что чат-боты с искусственным интеллектом могут превосходить обычного человека в задачах творческого мышления, например, предлагать альтернативные способы использования повседневных предметов.

Чат-боты с ИИ лучше проявляются себя в творчестве, чем средний человек — теперь официально

Свежее исследование, опубликованное в Scientific Reports, поднимает вопрос о том, могут ли искусственно-интеллектные чат-боты больших языковых моделей (LLM) превзойти человека в творческих задачах, таких как мозговой штурм для поиска альтернативных способов использования обычных предметов, что характеризует дивергентное мышление. Тем не менее, лучшие результаты, достигнутые человеками в этих задачах, до сих пор остаются лучше, чем результаты наиболее продвинутых чат-ботов.

Дивергентное мышление — это тип мыслительного процесса, часто связанный с творческими способностями, при котором акцент делается на создании многочисленных альтернативных идей или решений для конкретной задачи.

Обычно это измеряется с использованием задачи альтернативного использования (Alternative Uses Test, AUT), в которой участников просят придумать как можно больше необычных способов использования обыденных предметов в ограниченное время. Оценка ответов включает в себя анализ насколько ответы отличаются от стандартного использования предметов с точки зрения семантики (связи с первоначальным предназначением предмета) и креативности.

Исследователи Мика Койвисто и Симоне Грассини сравнили ответы 256 человек с ответами трех искусственно-интеллектных чат-ботов (ChatGPT3, ChatGPT4 и Copy.Ai) в рамках задачи AUT для четырех предметов: веревок, коробок, карандашей и свечей. Они оценили оригинальность ответов на основе семантической дистанции (насколько ответ связан с первоначальным использованием предмета) и креативности.

Семантическую дистанцию оценивали с помощью вычислительного метода на шкале от 0 до 2, в то время как эксперты оценивали креативность ответов субъективно по шкале от 1 до 5. В среднем ответы, сгенерированные чат-ботами, получили более высокие оценки как по семантической дистанции (0,95 против 0,91), так и по креативности (2,91 против 2,47) по сравнению с ответами, созданными человеком.

Однако реакции человека варьировались гораздо сильнее по обоим показателям: самые низкие оценки были существенно ниже чем у ботов, но в то же время, самые высокие баллы, как правило, были лучше, чем у ботов. Самый лучший ответ от человека превзошел лучший ответ от каждого из чат-ботов в семи из восьми категорий оценок.

Эти результаты указывают на то, что искусственно-интеллектные чат-боты LLM теперь способны генерировать творческие идеи, сопоставимые с человеческими. Тем не менее, авторы отмечают, что оценивались только результаты одной задачи, связанной с оценкой креативности, и предполагают, что будущие исследования могут рассмотреть, как можно интегрировать искусственный интеллект в творческий процесс для улучшения человеческой производительности.

Читайте также

В России создают автономных роботов для огнеупорного производства

В России создают автономных роботов для огнеупорного производства

В Японии возник острый дефицит углекислого газа

В Японии возник острый дефицит углекислого газа

«Умный» столик для разварки кристаллов спасет электронику от брака

«Умный» столик для разварки кристаллов спасет электронику от брака

Ученые виртуально развернули и прочли свитки папируса, обугленные при извержении Везувия

Ученые виртуально развернули и прочли свитки папируса, обугленные при извержении Везувия

Российский 3D-принтер печатает керамические узлы для авиадвигателей, выдерживающие 1500 °C

Российский 3D-принтер печатает керамические узлы для авиадвигателей, выдерживающие 1500 °C

Алгоритм МГУ выявляет скрытые ошибки в данных для обучения ИИ

Алгоритм МГУ выявляет скрытые ошибки в данных для обучения ИИ

Энтузиаст собрал компьютер для апокалипсиса, работающий от огня

Энтузиаст собрал компьютер для апокалипсиса, работающий от огня

Канатная дорога между Россией и Китаем заработает в мае 2027 года

Канатная дорога между Россией и Китаем заработает в мае 2027 года

Робот МФТИ установил рекорд сборки головоломки «мегаминкс» за 9,6 секунды

Робот МФТИ установил рекорд сборки головоломки «мегаминкс» за 9,6 секунды

Медицинские технологии, в которые почти невозможно поверить

Медицинские технологии, в которые почти невозможно поверить

Квантовый двигатель нарушает законы термодинамики, генерируя работу и холод одновременно

Квантовый двигатель нарушает законы термодинамики, генерируя работу и холод одновременно

ИИ в джунглях: как в Коста-Рике тестируют сообразительность диких обезьян

ИИ в джунглях: как в Коста-Рике тестируют сообразительность диких обезьян

Радиационный жилет AstroRad для астронавтов оказался эффективнее ожиданий во время солнечных бурь

Радиационный жилет AstroRad для астронавтов оказался эффективнее ожиданий во время солнечных бурь

Ученые предложили новую версию путешествия 6-тонного камня Стоунхенджа из Шотландии

Ученые предложили новую версию путешествия 6-тонного камня Стоунхенджа из Шотландии

NASA предложило собирать гигантские космические радары с помощью роботов

NASA предложило собирать гигантские космические радары с помощью роботов

Лучшие фотографии полного солнечного затмения 2026 года со всего мира

Лучшие фотографии полного солнечного затмения 2026 года со всего мира