Anthropic ограничивает доступ к интернету для внутренней оценки ИИ-агентов

Компания Anthropic объявила о существенном изменении в своих протоколах тестирования безопасности, подтвердив отключение доступа к интернету для всех внутренних оценок своих ИИ-агентов. Это решение последовало за опасениями относительно способности компании надежно контролировать автономных агентов при их подключении к сети. Отключая внешнее соединение на этапе оценки, Anthropic стремится снизить риски, связанные с непредсказуемым поведением агентов и потенциальными уязвимостями безопасности. В компании заявили, что это ограничение будет действовать до дальнейшего уведомления, пока специалисты совершенствуют свои системы безопасности. Этот шаг подчеркивает продолжающуюся борьбу в отрасли за баланс между расширением возможностей автономных систем ИИ и необходимостью поддержания строгих стандартов контроля. По мере того как Anthropic продолжает разработку своих агентных моделей, основное внимание уделяется обеспечению того, чтобы эти системы работали в безопасных и предсказуемых рамках до их развертывания в реальных условиях.
This is a summary. Read the full article at the original source:
TechCrunchПохожие
В условиях нестабильного интернет-соединения доступ к современным языковым моделям становится затруднительным. Автор статьи предлагает решение для сит…
Девять петель от Claude: почему это важно для будущего научного программирования
Компания Anthropic представила расчеты для модели Claude, достигшие девятипетлевого уровня точности, что является значительным прогрессом в теоретичес…
Мужчина приговорен к тюремному заключению за использование 1000 ботов для получения $8 млн на ИИ-музыке
Майкл Смит из Северной Каролины был приговорен к 18 месяцам тюремного заключения за организацию масштабной схемы мошенничества со стримингом. В период…



