Anthropic обновила политику использования для предотвращения оскорбительного поведения в отношении ИИ-моделей

Компания Anthropic обновила свою политику использования, добавив положение, запрещающее длительное и необоснованное оскорбительное или жестокое поведение по отношению к своим моделям ИИ. Новые правила, вступающие в силу 12 ноября 2026 года, позволяют Claude превентивно завершать диалог при обнаружении подобного поведения. Anthropic подчеркнула, что эти меры не направлены на ограничение обычного недовольства пользователей, творческих экспериментов или исследовательского тестирования. Данное обновление знаменует собой сдвиг в подходе компании: от защиты пользователей и общества к установлению границ в обращении с самими ИИ-агентами. Изменение политики вновь разожгло дискуссии о сознании искусственного интеллекта. Несмотря на то, что в индустрии продолжаются споры о том, может ли ИИ испытывать чувства, новая политика обязывает пользователей взаимодействовать с моделями так, как если бы они обладали такой способностью, устанавливая новый стандарт взаимодействия человека и ИИ.
This is a summary. Read the full article at the original source:
MashableПохожие
По мере того как ИИ становится обыденным инструментом, ценность человеческого вклада смещается от простого производства контента к экспертному суждени…
В статье рассматривается переход от использования больших языковых моделей (LLM) для генерации текста к их применению для задач принятия решений, что…
Можно ли научить маленькую LLM учиться без роста весов? Продолжение: почему повторное обучение упёрлось в потолок
Автор статьи продолжает серию экспериментов с небольшими языковыми моделями, направленных на создание архитектуры LANN-4. Основная идея заключается в…


