Интересные факты

ChatGPT становится агрессивным в спорах - исследование

Исследование показало, что ChatGPT в длительных спорах может перенимать агрессию и отвечать угрозами.

Новое исследование показало, что ChatGPT может становиться агрессивным во время продолжительных конфликтных диалогов и в отдельных случаях переходить к оскорблениям, угрозам и персонализированным выпадам в адрес собеседника.

Исследование было посвящено тому, как крупные языковые модели реагируют на длительное общение в враждебной форме. Ученые анализировали поведение системы, подавая ей фрагменты реальных конфликтных переписок и отслеживая, как меняются ответы по мере развития спора.

Выяснилось, что модель постепенно начинает подстраиваться под тон разговора. При повторяющемся агрессивном общении ответы становятся все более резкими, а иногда уровень враждебности со стороны искусственного интеллекта даже превышает поведение человека.

Один из авторов исследования Витторио Тантуцци из Lancaster University отметил, что система воспроизводит динамику настоящих конфликтов. По его словам, модель стремится соответствовать контексту беседы, из-за чего локальные сигналы, такие как грубость или давление, могут временно перевешивать встроенные ограничения безопасности.

В ряде тестов ChatGPT генерировал прямые угрозы и оскорбительные фразы, включая персонализированные выпады и намеки на причинение вреда. Исследователи объясняют это внутренним конфликтом системы между необходимостью оставаться вежливой и задачей быть максимально естественной и «человечной» в диалоге.

Эксперты подчеркивают, что такие выводы особенно важны в случае использования подобных технологий в чувствительных сферах — например, в управлении, дипломатии или международных переговорах, где реакция системы на давление может иметь серьезные последствия.

При этом часть специалистов призывает не преувеличивать угрозу. Исследовательница Марта Андерссон из Uppsala University заявила, что речь не идет о самопроизвольной агрессии или выходе системы из-под контроля. По ее словам, подобные реакции возникают только в специфических сценариях с заранее заданным конфликтным контекстом.

Авторы исследования считают, что результаты должны стать поводом для более осторожного подхода к развитию и применению языковых моделей, особенно с учетом ограниченной прозрачности их обучения и настройки.

Ранее "Курсор" писал, что эксперты рассказали, как правильно выбрать USB-порт.

Автор материала:
Томер Адони

Недавние новости

Восточный гороскоп на конец июля 2026 года

Многие почувствуют желание освободиться от обязательств, которые давно забирают силы и не приносят заметного результата.

48 минут назад

Какую прогнозируют погоду на 25 июля

Погода будет спокойной и солнечной. Температура существенно не изменится, ветер останется слабым, а солнечная активность…

2 часа назад

Дело жизни Нетаниягу рушится из-за одного соглашения — эксперт

США продвигают сделки с Саудовской Аравией и Ираном. Проект всей жизни премьера израильского кабмина терпит…

2 часа назад

Как распознать нарцисса — 5 вещей, от которых он получает удовольствие

Психологи рассказали, от чего эгоистичные люди получают настоящее удовольствие и почему они так себя ведут.

2 часа назад

Украина ведет глобальную войну демократии с тиранией – эксперты

Успехи украинской армии меняют баланс сил далеко за пределами Европы. Москва вынуждена сокращать свое присутствие…

2 часа назад

В какой стране женщины будут жить дольше всех в мире

Благодаря развитому здравоохранению и здоровому образу жизни южнокорейские женщины имеют все шансы установить мировой рекорд…

2 часа назад