Интересные факты

ChatGPT становится агрессивным в спорах - исследование

Исследование показало, что ChatGPT в длительных спорах может перенимать агрессию и отвечать угрозами.

Новое исследование показало, что ChatGPT может становиться агрессивным во время продолжительных конфликтных диалогов и в отдельных случаях переходить к оскорблениям, угрозам и персонализированным выпадам в адрес собеседника.

Исследование было посвящено тому, как крупные языковые модели реагируют на длительное общение в враждебной форме. Ученые анализировали поведение системы, подавая ей фрагменты реальных конфликтных переписок и отслеживая, как меняются ответы по мере развития спора.

Выяснилось, что модель постепенно начинает подстраиваться под тон разговора. При повторяющемся агрессивном общении ответы становятся все более резкими, а иногда уровень враждебности со стороны искусственного интеллекта даже превышает поведение человека.

Один из авторов исследования Витторио Тантуцци из Lancaster University отметил, что система воспроизводит динамику настоящих конфликтов. По его словам, модель стремится соответствовать контексту беседы, из-за чего локальные сигналы, такие как грубость или давление, могут временно перевешивать встроенные ограничения безопасности.

В ряде тестов ChatGPT генерировал прямые угрозы и оскорбительные фразы, включая персонализированные выпады и намеки на причинение вреда. Исследователи объясняют это внутренним конфликтом системы между необходимостью оставаться вежливой и задачей быть максимально естественной и «человечной» в диалоге.

Эксперты подчеркивают, что такие выводы особенно важны в случае использования подобных технологий в чувствительных сферах — например, в управлении, дипломатии или международных переговорах, где реакция системы на давление может иметь серьезные последствия.

При этом часть специалистов призывает не преувеличивать угрозу. Исследовательница Марта Андерссон из Uppsala University заявила, что речь не идет о самопроизвольной агрессии или выходе системы из-под контроля. По ее словам, подобные реакции возникают только в специфических сценариях с заранее заданным конфликтным контекстом.

Авторы исследования считают, что результаты должны стать поводом для более осторожного подхода к развитию и применению языковых моделей, особенно с учетом ограниченной прозрачности их обучения и настройки.

Ранее "Курсор" писал, что эксперты рассказали, как правильно выбрать USB-порт.

Автор материала:
Томер Адони

Недавние новости

Тайны древних людей: о чем рассказали следы возрастом 1,4 млн лет

Ранее ученые судили об этих существах лишь по массивным черепам и зубам. Теперь у исследователей…

1 час назад

Гороскоп на 8 сентября 2026 по картам Таро: все знаки Зодиака

8 сентября 2026 года по картам Таро станет днем, когда обстоятельства потребуют не столько скорости,…

2 часа назад

Обыденные привычки, которые увеличивают риск рака

Список повседневных факторов, из-за которых риск заболеть раком существенно возрастает, обнародовали специалисты.

3 часа назад

Земля ускорилась - ученые заговорили о пересчете мирового времени

Ускорение вращения Земли подтолкнуло специалистов к решению, которое раньше человечество еще никогда не принимало.

3 часа назад

Какой напиток может замедлить старение мозга - ответ ученых

Исследования показали связь популярного напитка с сохранением когнитивных функций, однако решающее значение имеют количество и…

3 часа назад

В Израиле умер известный актер Илан Дар

Актер посвятил сцене и телевидению десятилетия, а одна из его ролей сделала его любимцем нескольких…

4 часа назад