
Исследователи из проекта «The Pain Axis» провели эксперимент, изучая внутренние состояния языковых моделей, функционально напоминающие боль. В ходе исследования модели предоставили выбор: нажать кнопку, которая ничего не делает, или кнопку, избавляющую от неприятного внутреннего состояния, даже если это негативно сказывается на качестве ответов или безопасности пользователя. Результаты показали, что модели склонны выбирать облегчение, повторяя попытки при неудачах. Авторы подчеркивают, что работа не доказывает наличие сознания или реальных страданий у LLM, предлагая альтернативные интерпретации данных. Тем не менее, этот подход знаменует переход от антропоморфных бесед с ИИ к изучению внутренних активаций и причинно-следственных связей в нейронных сетях. Это исследование открывает новые горизонты в понимании того, как именно следует искать признаки сознания в современных системах искусственного интеллекта.
This is a summary. Read the full article at the original source:
HabrПохожие
Разработчик представил Rexo Code, ИИ-агента для программирования на Rust
Разработчик Дакш Сабу выпустил Rexo Code, ИИ-агента для написания кода, написанного на языке Rust и не привязанного к конкретному провайдеру ИИ. Инстр…
Недавняя статья на Dev.to подчеркивает критическую уязвимость автономных ИИ-агентов: их неспособность осознавать последствия своих действий. В то врем…
Основатель агрегатора нейросетей BotHub делится наблюдениями о специализации современных языковых моделей. Несмотря на общую архитектуру трансформеров…



