Технологии

Когда чат-боты "врут" чаще всего - исследование выявило интересную закономерность

Просьбы к чат-ботам давать краткие ответы могут привести к увеличению галлюцинаций.

Исследование компании Giskard, которая занимается созданием комплексного бенчмарка для оценки моделей искусственного интеллекта, выявило интересный парадокс: если попросить чат-бот отвечать как можно короче, вероятность возникновения «галлюцинаций» у него возрастает.

Об этом говорится в сообщении в блоге.

Специалисты отмечают, что такая особенность особенно выражена у наиболее продвинутых систем — например, GPT-4o от OpenAI, Mistral Large и Claude 3.7 Sonnet. При требовании быть лаконичными эти модели чаще допускают ошибки и выдают неточные данные.

Причина, по мнению исследователей, кроется в том, что короткий формат ответа лишает нейросеть возможности пояснять, уточнять или опровергать информацию. Для качественного фактического опровержения почти всегда требуется более развёрнутое объяснение.

«Когда системе задают установку отвечать предельно сжато, она неизбежно жертвует точностью в пользу краткости, — указывают авторы работы. — Это значит, что даже безобидные указания вроде "отвечайте коротко" могут серьёзно подорвать способность модели корректировать дезинформацию».

Кроме того, в отчёте подчеркивается ещё одна закономерность: если ложное утверждение сформулировано уверенно, многие модели предпочитают его не опровергать. Для разработчиков это создаёт непростую дилемму — что важнее, удобство для пользователя или сохранение надёжности выдачи.

Проблема «галлюцинаций» — генерации вымышленных или некорректных сведений — остаётся нерешённой даже для самых современных ИИ-систем. Более того, отмечается, что новейшие модели рассуждений, такие как OpenAI o3, нередко демонстрируют ещё более высокий уровень подобных ошибок, чем их предшественники.

Напомним, "Курсор" писал о том что хакер под псевдонимом «Плиний Освободитель» создал модель искусственного интеллекта (ИИ), способную выполнять задачи в Даркнете, включая найм киллеров. Эксперимент, получивший название «Агент 47», стал шокирующим примером того, как передовые технологии могут быть использованы в криминальных целях.

Автор материала:
Тали Малкина

Недавние новости

Симптомы опасной болезни, которые проявляются на ступнях

Эксперты подсказали еще один признак диабета, который можно заметить на своих ступнях на ранней стадии.

54 секунды назад

Трамп готовит ответ за бойкот Израиля - кто оказался под угрозой

Вашингтон предупредил европейские правительства о возможных ответных мерах, которые способны затронуть даже ближайших союзников США.

2 минуты назад

Привет Путину: НАТО развернет масштабные ядерные учения возле РФ

В Альянсе подчеркивают, что маневры плановые и не представляют угрозы для Москвы. Но сигнал все…

11 минут назад

Главные ошибки в приготовлении домашних блюд назвали профессионалы

Эксперты говорят, что эти ошибки на кухне допускает большинство хозяек. И некоторые из них могут…

18 минут назад

Саудовская Аравия нанесла удар по хуситам - что удалось захватить

В ходе наступления особое значение приобрел небольшой остров, способный изменить расстановку сил на всем побережье…

26 минут назад

ТОП-3 ошибки в использовании унитаза, которые ударят по бюджету

Проблемы с сантехникой редко возникают внезапно и чаще всего развиваются постепенно. Своевременное внимание к деталям…

31 минута назад