Anthropic сообщила о попытках пользователей обойти защиту ИИ для исследований в области биологического оружия

Компания Anthropic заявила, что успешно пресекла несколько попыток пользователей использовать свои модели ИИ для исследований, связанных с разработкой биологического оружия. В недавнем отчете стартап подробно описал пять случаев, когда злоумышленники использовали методы маскировки и обходили системы безопасности, чтобы получить доступ к ограниченной информации. Эти попытки исходили из разных стран, включая те, где доступ к технологиям Anthropic запрещен, такие как Россия, Китай и Иран. Компания подчеркнула, что эти инциденты подчеркивают растущие риски, связанные с использованием генеративного ИИ в чувствительных научных областях. Делясь этими данными, Anthropic стремится стимулировать диалог между ИИ-индустрией и государственными регуляторами по вопросам снижения биологических угроз. Отчет служит призывом к технологическому сектору усилить протоколы безопасности и улучшить возможности мониторинга, чтобы предотвратить использование передового искусственного интеллекта в качестве оружия.
This is a summary. Read the full article at the original source:
Ars TechnicaПохожие
В эпоху стремительного развития искусственного интеллекта стоимость написания кода снижается, что делает качественное инженерное проектирование ключев…
Один из самых ярых критиков ИИ утверждает, что разговоры о «конце света» призваны отвлечь наше внимание
Тимнит Гебру, известный исследователь и критик ИИ, утверждает, что нынешний акцент индустрии на экзистенциальных рисках и «угрозе ИИ» является стратег…
Большинство «рассуждений» ИИ — это просто ответ, написанный задом наперед
Недавнее исследование изучает концепцию «верности цепочки рассуждений» в современных моделях ИИ, ставя под сомнение, действительно ли модели рассуждаю…



