Ո՞վ է ուղղորդում ուղղորդողներին

Իր վերջին վերլուծության մեջ Պրեստոն Բիրնը ուսումնասիրում է արհեստական բանականության համակարգերի ուղղորդման (alignment) հետ կապված բարդ մարտահրավերները։ Հոդվածը քննարկում է այն դժվարությունները, որոնք առաջանում են ապահովելու համար, որ ԱԲ մոդելները մնան մարդկային արժեքներին և անվտանգության արձանագրություններին համահունչ, քանի որ դրանք դառնում են ավելի ինքնավար։ Բիրնը քննադատում է արդյունաբերության ներկայիս կախվածությունը կենտրոնացված ուղղորդման մեխանիզմներից՝ կասկածի տակ դնելով այն կազմակերպությունների թափանցիկությունն ու հաշվետվողականությունը, որոնք պատասխանատու են այս հզոր գործիքների կառավարման համար։ Նա պնդում է, որ հենց «ուղղորդողները»՝ հետազոտողներն ու կորպորացիաները, չունեն բավարար վերահսկողություն, ինչը կարող է նոր ռիսկեր ստեղծել։ Հոդվածը կոչ է անում ԱԲ կառավարման ավելի ապակենտրոնացված և խիստ մոտեցման՝ ընդգծելով, որ տեխնիկական լուծումները բավարար չեն առանց ինստիտուցיוնալ վերահսկողության։ Շեշտելով ուժային դինամիկան՝ Բիրնը հրավիրում է անհրաժեշտ քննարկման այն մասին, թե ով ունի «անվտանգ» ԱԲ սահմանելու իրավասություն։
This is a summary. Read the full article at the original source:
Hacker News (YC)Կապակցված
Ես փորձարկեցի Meta-ի նոր Muse AI գործակալը. այն անհավանականորեն օգտակար է, բայց թվային կյանքս նրան վստահելը խորապես անհարմար էր
Meta-ն ներկայացրել է Muse-ը՝ անհատական AI գործակալ, որը նախատեսված է օգտատերերի անունից առցանց առաջադրանքներ կատարելու համար, ինչպիսիք են գնումները, է…
Ինչպես աշխատել GPT Image 2.5-ի հետ. OpenAI-ի խորհուրդները և Reddit-ի համայնքի փորձը
OpenAI-ը հրապարակել է պաշտոնական ուղեցույց GPT Image 2.5 մոդելի համար պրոմպտներ կազմելու վերաբերյալ, որը նպատակ ունի բարելավել պատկերների գեներացման ո…
Ի՞նչ է գործակալի «սանձը» (Agent Harness). Հարնես-ինժեներիայի բացատրությունը
Dev.to-ում հրապարակված հոդվածում Թեջաս Կումարը ներկայացնում է «գործակալի սանձի» (agent harness) հայեցակարգը՝ որպես AI մոդելների հուսալիությունն ապահով…


