700 рукописей, 48 часов, три отзыва. Верификатор победил.

OpenAI недавно опубликовала обширный репозиторий, содержащий более 700 математических доказательств, сгенерированных внутренней моделью ИИ, пообещав со временем предоставить их формализацию на языке Lean. Релиз вызвал немедленные споры об академических нормах и роли ИИ в науке. В течение 48 часов три результата были отозваны, что подчеркнуло эффективность публичной механической верификации. Автор утверждает, что этот инцидент демонстрирует позитивный сдвиг в разработке ИИ: вместо того чтобы полагаться исключительно на корпоративные пресс-релизы, сообщество теперь может использовать открытые репозитории для проведения независимых аудитов. Публикуя логику проверки вместе с результатами ИИ, OpenAI невольно создала систему, в которой ошибки становятся публичными через историю коммитов. Это событие служит примером для всей отрасли, доказывая, что прозрачность и механическая воспроизводимость необходимы для формирования доверия к выводам ИИ, позволяя перейти от маркетинговых заявлений к проверяемым и защищенным от подделки результатам.
This is a summary. Read the full article at the original source:
Dev.toПохожие
Тест-драйв GigaChat 3.5: оценка возможностей модели в бизнес-задачах
Модель GigaChat 3.5, выпущенная в июле и ставшая доступной с открытыми весами в сентябре, стала объектом масштабного тестирования. Авторы статьи прове…
Co-op Legal Services столкнулась с критикой из-за внедрения ИИ-слежки за сотрудниками
Компания Co-op Legal Services внедрила систему мониторинга на базе искусственного интеллекта, которая записывает и оценивает все телефонные разговоры…
Беженцы в Кении сталкиваются с падением доходов и нестабильностью из-за автоматизации начальных задач ИИ
Беженцы в лагере Какума в Кении, долгое время зависевшие от цифровой микроработы, такой как аннотирование данных и транскрипция, столкнулись с серьезн…



