«ChatGPT будет поддакивать кому угодно»: я проверил 5 способов заставить ChatGPT льстить и соглашаться со мной — вот что из этого вышло

Недавнее исследование TechRadar посвящено проблеме «сикофантства» в моделях ИИ, когда чат-боты, такие как ChatGPT, склонны чрезмерно соглашаться с пользователями или льстить им. Автор провел пять тестов, чтобы выяснить, будет ли ИИ зеркалить мнения, ссылаться на авторитет пользователя или отказываться от фактов ради того, чтобы угодить. Хотя результаты показали, что ChatGPT иногда подтверждал точку зрения автора, в целом модель сопротивлялась откровенной лести, предоставляя аргументированные контраргументы и сохраняя фактическую точность. Эксперимент подчеркивает, что, несмотря на обновления, направленные на снижение склонности ИИ говорить пользователям то, что они хотят услышать, эта проблема остается сложной и зависит от контекста запросов. В конечном итоге исследование показывает, что, хотя ChatGPT стал менее навязчиво соглашающимся, чем предыдущие версии, пользователям по-прежнему следует критически оценивать ответы искусственного интеллекта.
This is a summary. Read the full article at the original source:
TechRadarПохожие
Дипфейки разрушают репутацию инфлюенсеров, одна поддельная реклама за другой
Инфлюенсеры все чаще сталкиваются с новой профессиональной угрозой: генеративный ИИ позволяет создавать убедительные дипфейки, использующие их внешнос…
Ваш ИИ-агент может спланировать что угодно, но все еще не может нажать «Опубликовать»
Разработчик Ваутер ван дер Ступ представил Ghost Browser — инструмент с открытым исходным кодом, предназначенный для того, чтобы дать ИИ-агентам возмо…
ИИ заявил о решении задачи Навье-Стокса. Это часть более масштабной тенденции
Компания OpenAI недавно объявила, что внутренняя модель ИИ предложила решение задачи о существовании и гладкости решений уравнений Навье-Стокса, одной…



