Իմ մեկնաբանությունների բաժինը նախագծեց իմ հաջորդ փորձը. Հետո այն ստիպեց ինձ սառեցնել իմ կանխատեսումները:

Անվտանգության հետազոտող Ալի Աֆանան վերջերս անցկացրել է խիստ փորձ՝ ստուգելու համար, թե արդյոք լեզվական մոդելները ցուցաբերում են սիկոֆանտիա կոդի խոցելիությունը գնահատելիս: Նախորդ հոդվածից հետո, որտեղ նա նկատել էր, որ մոդելները համաձայնում են սկաների նշումների հետ, ընթերցողները վիճարկել են նրա մեթոդաբանությունը: Ի պատասխան՝ Աֆանան համագործակցել է իր լսարանի հետ՝ վերահսկվող փորձ նախագծելու համար՝ ներառելով չեզոք տարր՝ սկաների նախազգուշացումների «խարսխման էֆեկտը» մեկուսացնելու համար: Թեստերը գործարկելուց առաջ նա հրապարակավ հանձն է առել կոնկրետ կանխատեսումներ և վիճակագրական կանոններ՝ ապահովելով թափանցիկություն: Արդյունքները ցույց տվեցին, որ gpt-4o-mini-ի նման մոդելները ավելի շուտ «գերզեկուցողներ» են, քան սիկոֆանտներ՝ հաստատելով խոցելիությունները՝ անկախ արտաքին հուշումներից: Այս համագործակցային մոտեցումը ընդգծում է նախնական գրանցման արժեքը AI-ի գնահատման մեջ՝ ցույց տալով, թե ինչպես հանրային գրախոսությունը կարող է անեկդոտային դիտարկումները վերածել գիտական հետազոտության:
This is a summary. Read the full article at the original source:
Dev.toԿապակցված
Արհեստական բանականությունը կփոխակերպի կապիտալիզմը. բայց ինչպե՞ս:
The Guardian-ի համար գրված իր վերլուծության մեջ Փոլ Մեյսոնը քննարկում է արհեստական բանականության (ԱԲ) ներուժը՝ հիմնովին վերափոխելու կապիտալիստական համ…
Հոդվածի հեղինակը խորհում է նեյրոնային ցանցերի ստեղծագործական ներուժի մասին՝ պատասխանելով այն թերահավատ պնդումներին, թե արհեստական բանականությունը չի կ…
Սիլիկոնյան հովիտը ռազմավարական նշանակալի փոփոխություն է կատարում՝ պարզ չաթ-բոտերից անցում կատարելով դեպի գործակալային AI-ի (agentic AI) զարգացում։ Այս…



