Исследователи использовали Claude для взлома OpenAI

Группа исследователей кибербезопасности успешно продемонстрировала уязвимость в системах OpenAI, используя ИИ Claude от компании Anthropic. Исследователи, участвовавшие в санкционированной программе по поиску уязвимостей, получили несанкционированный доступ к учетной записи ChatGPT сотрудника OpenAI. Этот взлом позволил им просматривать конфиденциальную программную информацию и предлагать изменения в коде. Операция была проведена с помощью инструмента Anthropic, специально разработанного для специалистов по безопасности для выявления слабых мест в моделях ИИ. Этот инцидент подчеркивает растущую важность состязательного тестирования, поскольку ведущие ИИ-компании сталкиваются с повышенным вниманием к безопасности своих платформ. Используя технологии конкурента для обнаружения этих недостатков, исследователи подчеркивают критическую необходимость надежных мер безопасности при разработке генеративного ИИ. OpenAI продолжает сотрудничать с экспертами по безопасности для устранения этих уязвимостей и предотвращения потенциальных атак со стороны злоумышленников, подчеркивая совместный характер современных исследований в области кибербезопасности.
This is a summary. Read the full article at the original source:
Ars TechnicaПохожие
Как ИИ-агенты могут привести к неконтролируемым расходам для предприятий
По мере того как предприятия все чаще внедряют автономных ИИ-агентов в свои рабочие процессы, возникает значительный финансовый риск: неконтролируемое…
Чтобы остановить неконтролируемые угрозы ИИ, нужно больше, чем просто разговоры о P(doom)
В своей гостевой колонке для CNET автор Джейми Бартлетт исследует растущие риски, связанные с передовым искусственным интеллектом. Бартлетт утверждает…
OpenAI формирует математическую консультативную группу, так как её ИИ решил более 100 открытых задач
OpenAI официально создала специализированную математическую консультативную группу для контроля за исследованиями в области продвинутого ИИ-мышления.…



