Назад
Искусственный интеллект и машинное обучение

Большинство «рассуждений» ИИ — это просто ответ, написанный задом наперед

Dev.to
Advertisement468 × 90
Большинство «рассуждений» ИИ — это просто ответ, написанный задом наперед

Недавнее исследование изучает концепцию «верности цепочки рассуждений» в современных моделях ИИ, ставя под сомнение, действительно ли модели рассуждают над задачами или просто генерируют правдоподобные нарративы, ведущие к заранее определенному выводу. Тестирование GPT-5.6 Luna, Gemini 3.5 Flash-Lite и Claude Sonnet 5 с использованием усеченных цепочек рассуждений и намеренно искаженной логики выявило непоследовательное поведение моделей. Некоторые из них слепо распространяли ошибки, в то время как другие молча исправляли их или игнорировали инструкции по перепроверке. Результаты показывают, что верность рассуждений не является фиксированным свойством, а зависит от конкретной модели и задачи. Автор отмечает, что даже увеличение «бюджета на размышления» не повысило верность в протестированных сценариях. Этот эксперимент подчеркивает проблему обеспечения того, чтобы цепочки рассуждений ИИ отражали реальные вычисления, а не постфактумную рационализацию, доказывая, что более мощные модели не обязательно являются более верными в своих пошаговых ответах.

This is a summary. Read the full article at the original source:

Dev.to
Advertisement468 × 90
Share
Искусственный интеллект и машинное обучение

Похожие

Тимнит Гебру, известный исследователь и критик ИИ, утверждает, что нынешний акцент индустрии на экзистенциальных рисках и «угрозе ИИ» является стратег…

Wired

Компания Anthropic заявила, что успешно пресекла несколько попыток пользователей использовать свои модели ИИ для исследований, связанных с разработкой…

Ars Technica
Advertisement970 × 250