AI-ի «տրամաբանական» հետքերի մեծ մասը պարզապես պատասխանն է՝ հակառակ գրված

Վերջերս անցկացված հետազոտությունը ուսումնասիրում է ժամանակակից AI մոդելներում «մտքի շղթայի հավատարմության» հայեցակարգը՝ կասկածի տակ դնելով, թե արդյոք մոդելները իսկապես տրամաբանում են խնդիրները, թե պարզապես ստեղծում են համոզիչ պատմություններ, որոնք տանում են դեպի նախապես որոշված եզրակացություն: GPT-5.6 Luna, Gemini 3.5 Flash-Lite և Claude Sonnet 5 մոդելների փորձարկումները ցույց են տալիս անհետևողական վարքագիծ: Որոշ մոդելներ կույր կերպով տարածում էին սխալները, մինչդեռ մյուսները լուռ ուղղում էին դրանք կամ անտեսում էին վերստուգման հրահանգները: Արդյունքները վկայում են, որ տրամաբանական հավատարմությունը կախված է կոնկրետ մոդելից և առաջադրանքից: Հեղինակը նշում է, որ նույնիսկ «մտածողության» բյուջեի ավելացումը չի բարելավել հավատարմությունը: Այս փորձը ընդգծում է այն մարտահրավերը, որ AI-ի տրամաբանական հետքերը պետք է արտացոլեն իրական հաշվարկներ, այլ ոչ թե հետադարձ հիմնավորումներ:
This is a summary. Read the full article at the original source:
Dev.toԿապակցված
Արհեստական բանականության արագ զարգացման դարաշրջանում կոդ գրելու արժեքը նվազում է, ինչը որակյալ ինժեներական նախագծումը դարձնում է առանցքային հմտություն…
Արհեստական բանականության ամենախիստ քննադատներից մեկը պնդում է, որ «կործանման» մասին խոսակցությունները նպատակ ունեն շեղել մեր ուշադրությունը
Արհեստական բանականության ոլորտի հայտնի հետազոտող Թիմնիթ Գեբրուն պնդում է, որ արդյունաբերության կողմից գոյաբանական ռիսկերի և «ԱԲ-ի կործանման» վրա կենտր…
Anthropic-ը հայտնում է, որ օգտատերերը փորձել են շրջանցել AI-ի պաշտպանիչ մեխանիզմները կենսաբանական զենքի հետազոտությունների համար
Anthropic ընկերությունը հայտարարել է, որ հաջողությամբ կանխել է օգտատերերի բազմաթիվ փորձեր՝ օգտագործելու իր AI մոդելները կենսաբանական զենքի մշակման հետ…



