Ձեր LLM հեռաչափության աղյուսակը չունի մեկ հայտարար

Վերջերս հրապարակված տեխնիկական նշումներում հեղինակը զգուշացնում է LLM հեռաչափության տվյալները որպես միասնական ամբողջություն դիտարկելու վտանգի մասին: Տարբեր մոդելների արդյունավետության ցուցանիշները վերլուծելիս ծրագրավորողները հաճախ սխալմամբ միավորում են չափման տարբեր միավորներ՝ ինչպիսիք են թելերի մակարդակի ավարտման պրոքսիները և դարաշրջաններով վերագրված հատվածները: Այս մոտեցումը ստեղծում է ապակողմնորոշիչ համեմատություններ, քանի որ այդ ցուցանիշների հայտարարները փոխարինելի չեն: Հեղինակը պնդում է, որ մոդելի անունը վերլուծության կայուն միավոր չէ, և հեռաչափության հաշվետվությունները պետք է հաշվի առնեն այնպիսի փոփոխականներ, ինչպիսիք են դերը, առաջադրանքների ընտանիքը և առաքման քաղաքականությունը: Այս շերտերի միջև տարբերություն չդնելով՝ ինժեներները ռիսկի են դիմում ստանալ ոչ թե գործնական եզրակացություններ, այլ պարզապես տվյալների պատմվածքներ: Հոդվածը եզրափակվում է հեռաչափության գրանցման խիստ շրջանակի առաջարկով՝ ընդգծելով, որ կատարողականի բացերը պետք է դիտարկել որպես ասոցիացիաներ, այլ ոչ թե պատճառահետևանքային ապացույցներ:
This is a summary. Read the full article at the original source:
Dev.toԿապակցված
Ինչպե՞ս կարող են AI գործակալները հանգեցնել ձեռնարկությունների համար անվերահսկելի ծախսերի
Քանի որ ձեռնարկություններն ավելի ու ավելի են ինտեգրում ինքնավար AI գործակալներն իրենց աշխատանքային գործընթացներում, ի հայտ է եկել ֆինանսական լուրջ ռիս…
AI-ի անվերահսկելի վտանգները կանխելու համար անհրաժեշտ է ավելին, քան պարզապես խոսակցություններ P(doom)-ի մասին
CNET-ի հյուրընկալված սյունակում հեղինակ Ջեյմի Բարթլեթը քննարկում է առաջադեմ արհեստական բանականության հետ կապված աճող ռիսկերը: Բարթլեթը պնդում է, որ «P…
OpenAI-ն ստեղծում է մաթեմատիկական խորհրդատվական խումբ, քանի որ նրա AI-ն լուծել է ավելի քան 100 բաց խնդիր
OpenAI-ն պաշտոնապես ստեղծել է մաթեմատիկական խորհրդատվական խումբ՝ վերահսկելու առաջադեմ AI տրամաբանության ոլորտում իր հետազոտությունները: Այս քայլը հաջո…



