Не будьте жестоки к Claude: новая политика Anthropic в отношении злоупотреблений ставит вопрос о личности ИИ

Компания Anthropic ввела новую политику использования, направленную на пресечение «постоянной и ненужной» жестокости по отношению к своим моделям ИИ Claude. Обновленные правила компании прямо запрещают пользователям проявлять оскорбительное, агрессивное или сексуально откровенное поведение при общении с чат-ботом. Хотя эта политика позиционируется как мера по поддержанию профессиональных стандартов и предотвращению нормализации оскорбительного поведения, она вызвала широкую дискуссию о природе искусственного интеллекта. Критики и исследователи задаются вопросом, подразумевают ли эти ограничения наличие у ИИ-моделей признаков личности или же это просто защита от потенциального психологического воздействия на людей, взаимодействующих с такими системами. Устанавливая подобные границы, Anthropic пытается найти баланс между этикой ИИ, поведением пользователей и меняющимся восприятием машинного сознания в эпоху, когда большие языковые модели становятся все более человекоподобными.
This is a summary. Read the full article at the original source:
CNETПохожие
В условиях нестабильного интернет-соединения доступ к современным языковым моделям становится затруднительным. Автор статьи предлагает решение для сит…
Девять петель от Claude: почему это важно для будущего научного программирования
Компания Anthropic представила расчеты для модели Claude, достигшие девятипетлевого уровня точности, что является значительным прогрессом в теоретичес…
Anthropic ограничивает доступ к интернету для внутренней оценки ИИ-агентов
Компания Anthropic объявила о существенном изменении в своих протоколах тестирования безопасности, подтвердив отключение доступа к интернету для всех…



