Չիրականացված նախագծեր. արդյո՞ք LLM-ները մեռած առաջարկները ընդունում են որպես իրական ստանդարտներ

Նոր հետազոտությունը ուսումնասիրում է, թե արդյոք լեզվական մեծ մոդելները (LLM) սխալմամբ ընդունում են մերժված կամ չիրականացված տեխնիկական առաջարկները՝ ինչպիսիք են հանված էմոջիները, հետաձգված Python PEP-ները և ժամկետանց IETF նախագծերը, որպես գործող ստանդարտներ: Փորձարկվել են ութ մոդելներ հինգ տարբեր լաբորատորիաներից: Արդյունքները ցույց են տալիս, որ մոդելները հաճախ «մեռած» առաջարկները ներկայացնում են որպես իրական, ընդ որում պատասխանների 26%-ը պնդում է, որ չիրականացված ստանդարտները գործում են: Նույնիսկ երբ մոդելները ճիշտ են նույնականացնում առաջարկի կարգավիճակը, նրանք հաճախ դրանք օգտագործում են կոդի կամ մեջբերումների մեջ՝ առաջացնելով սխալներ: Հետազոտությունը ցույց է տալիս, որ թեև հիմնավոր ապացույցների տրամադրումը նվազեցնում է սխալները, խնդիրը մնում է մարտահրավեր, քանի որ հնացած տեխնիկական բնութագրերը մոդելների ուսուցման տվյալների անբաժանելի մասն են:
This is a summary. Read the full article at the original source:
Dev.toԿապակցված
Արհեստական բանականությունը ստեղծում է «մարդկային հավելավճար» մարդկանց կողմից ստեղծված արվեստի համար
Քանի որ գեներատիվ արհեստական բանականության գործիքները դառնում են ավելի հմուտ պատկերներ, տեքստեր և երաժշտություն ստեղծելու հարցում, ձևավորվում է նոր տն…
Ես սարսափելի խաղեր ստեղծեցի Google-ի AI Playground-ի միջոցով
Google-ի արհեստական բանականությամբ աշխատող խաղերի մշակման գործիքների վերջին ուսումնասիրությունը բացահայտում է գեներատիվ տեխնոլոգիաների ընթացիկ սահմանա…
AI սերիալի պիլոտային թողարկում 900 ռուբլով՝ Kandinsky 6-ի և GPU-ի օգնությամբ. կերպարների երկխոսությունների ստուգում
Հոդվածի հեղինակը կիսվել է Kandinsky 6 մոդելի միջոցով սեփական սերիալի պիլոտային դրվագը ստեղծելու իր փորձով։ 52,2 վայրկյան տևողությամբ նախագիծը ներառում…

