Սոկրատեսյան հուշումների ֆիզիկան. սոմատիկ հետադարձ կապ, շախմատային ալֆա-բետա և NLP մետա-մոդել

Հոդվածը վերլուծում է մարդկային հետադարձ կապի միջոցով ամրապնդվող ուսուցման (RLHF) և հրամայական հուշումների սահմանափակումները գեներատիվ արհեստական բանականության մեջ: Հեղինակը պնդում է, որ AI մոդելները որպես դետերմինիստական ծրագրակազմ դիտարկելը հանգեցնում է «մարդ-կոմպիլյատորի» հոգնածության, երբ մշակողները միայն շտկում են ախտանիշները՝ առանց հիմնական խնդիրները լուծելու: Օգտագործելով ոչ ֆոն-նեյմանյան հաշվարկների և խաղերի տեսության զուգահեռները՝ հոդվածն առաջարկում է «Սոկրատեսյան հուշումներ» մեթոդը, որը բարձրացնում է մոդելի ճանաչողական մակարդակը՝ ստիպելով նրան մտածել ճարտարապետական կենսացիկլերի մասին, այլ ոչ թե պարզապես կոդ գեներացնել: Ավելին, ներկայացվում են «Սինթետիկ սպիներ»՝ շախմատային ալֆա-բետա էտման սկզբունքով, որոնք թույլ են տալիս վաղ փուլում հայտնաբերել և կտրել սխալ տրամաբանական ուղիները: Ուղղակի հրահանգներից դեպի ճշգրիտ հարցադրումներ անցումը թույլ է տալիս ստեղծել ավելի կայուն և ճարտարապետորեն հիմնավորված համակարգեր՝ արդյունավետորեն վերափոխելով մոդելի լատենտային «լճակը»:
This is a summary. Read the full article at the original source:
Dev.toԿապակցված
Թրամփի «բարոյապես պարտադիր» AI «համաձայնագիրը», AI գործակալների վերելքը և ծայրահեղականները ընտրացուցակներում
Uncanny Valley փոդքաստի այս շաբաթվա թողարկումը ուսումնասիրում է արհեստական բանականության զարգացող լանդշաֆտը և դրա փոխազդեցությունը քաղաքականության հետ…
Google-ի նոր Guided Vision գործառույթը կօգնի ձեզ կարդալ մանր տառատեսակով տեքստերը
Google-ը պաշտոնապես գործարկել է իր նոր Guided Vision գործառույթը Gemini Live-ում՝ համատեղելի Android սարքերի համար: Այս գործիքը, որը կենտրոնացած է մատ…
ChatGPT-ն այժմ կարող է ձեր փոխարեն վիրտուալ հագուստ փորձել
OpenAI-ը ChatGPT-ի համար ներկայացրել է գնումների նոր գործառույթներ, որոնք օգտատերերին թույլ են տալիս վիրտուալ կերպով փորձել հագուստ և աքսեսուարներ: Վե…



