Ի՞նչ եք անում, երբ AI-ն կոդ է գրում. Ես ստիպում եմ իմին վիճել ինքն իր հետ

Ծրագրավորող Դեբաշիշ Գոսալը վերլուծում է AI-ի միջոցով կոդի ստուգման թերությունները՝ նշելով, որ բազմամոդելային համակարգերի մեծ մասը պարզապես «թատրոն» է խաղում՝ երկրորդ մոդելին կապելով առաջինի եզրակացությանը։ Այս խնդիրը լուծելու համար Գոսալը ստեղծել է «AdversarialDebate» համակարգը, որը ստիպում է երկու LLM-ների անկախ վերլուծել կոդը՝ առանց ընդհանուր համատեքստի, նախքան կառուցվածքային բանավեճի անցնելը։ Կանխելով մոդելների կողմից միմյանց եզրակացությունները տեսնելը՝ համակարգը վերացնում է կողմնակալությունը։ 150 արտեֆակտների վրա կատարված փորձարկումները ցույց են տվել 88,7% ճշգրտություն խնդիրների հայտնաբերման հարցում։ Գոսալը եզրակացնում է, որ AI-ի օգնությամբ իրական մշակումը պահանջում է պասիվ դիտարկումից անցնել ակտիվ, հակադիր ստուգման՝ կոդի որակն ապահովելու համար։
This is a summary. Read the full article at the original source:
Dev.toԿապակցված
Ինչպե՞ս կարող են AI գործակալները հանգեցնել ձեռնարկությունների համար անվերահսկելի ծախսերի
Քանի որ ձեռնարկություններն ավելի ու ավելի են ինտեգրում ինքնավար AI գործակալներն իրենց աշխատանքային գործընթացներում, ի հայտ է եկել ֆինանսական լուրջ ռիս…
AI-ի անվերահսկելի վտանգները կանխելու համար անհրաժեշտ է ավելին, քան պարզապես խոսակցություններ P(doom)-ի մասին
CNET-ի հյուրընկալված սյունակում հեղինակ Ջեյմի Բարթլեթը քննարկում է առաջադեմ արհեստական բանականության հետ կապված աճող ռիսկերը: Բարթլեթը պնդում է, որ «P…
OpenAI-ն ստեղծում է մաթեմատիկական խորհրդատվական խումբ, քանի որ նրա AI-ն լուծել է ավելի քան 100 բաց խնդիր
OpenAI-ն պաշտոնապես ստեղծել է մաթեմատիկական խորհրդատվական խումբ՝ վերահսկելու առաջադեմ AI տրամաբանության ոլորտում իր հետազոտությունները: Այս քայլը հաջո…



