Անվերջ պարամետրերով LLM-ներ. կշիռների գեներացում և հարմարեցում իրական ժամանակի տվյալներից

Հետազոտողները ներկայացրել են մեծ լեզվական մոդելների (LLM) նոր ճարտարապետություն, որը դուրս է գալիս պարամետրերի ստատիկ քանակի սահմաններից: «Անվերջ պարամետրերով LLM-ներ. կշիռների գեներացում և հարմարեցում իրական ժամանակի տվյալներից» վերնագրով աշխատությունն առաջարկում է շրջանակ, որտեղ մոդելի կշիռները դինամիկ կերպով գեներացվում և հարմարեցվում են իրական ժամանակում՝ հոսող տվյալների հիման վրա: Մոդելի հզորությունը նախապես մարզված պարամետրերի ֆիքսված հավաքածուից անջատելով՝ այս մոտեցումը թույլ է տալիս շարունակական ուսուցում և հարմարեցում՝ առանց ավանդական վերամարզման ցիկլերի անհրաժեշտության: Հեղինակները ցույց են տալիս, որ այս մեթոդը զգալիորեն բարելավում է արդյունավետությունը այն առաջադրանքներում, որոնք պահանջում են թարմ տեղեկատվություն և տիրույթին հատուկ համատեքստ: Այս բեկումնային մոտեցումը հուշում է դեպի ավելի ճկուն, «կենդանի» մոդելների անցում, որոնք կարող են զարգանալ իրենց մշակած տվյալներին զուգընթաց՝ հնարավորություն տալով նվազեցնել հսկայական մոդելների վերամարզման հետ կապված հաշվողական ծախսերը:
This is a summary. Read the full article at the original source:
Hacker News (YC)Կապակցված
Ինչպե՞ս կարող են AI գործակալները հանգեցնել ձեռնարկությունների համար անվերահսկելի ծախսերի
Քանի որ ձեռնարկություններն ավելի ու ավելի են ինտեգրում ինքնավար AI գործակալներն իրենց աշխատանքային գործընթացներում, ի հայտ է եկել ֆինանսական լուրջ ռիս…
AI-ի անվերահսկելի վտանգները կանխելու համար անհրաժեշտ է ավելին, քան պարզապես խոսակցություններ P(doom)-ի մասին
CNET-ի հյուրընկալված սյունակում հեղինակ Ջեյմի Բարթլեթը քննարկում է առաջադեմ արհեստական բանականության հետ կապված աճող ռիսկերը: Բարթլեթը պնդում է, որ «P…
OpenAI-ն ստեղծում է մաթեմատիկական խորհրդատվական խումբ, քանի որ նրա AI-ն լուծել է ավելի քան 100 բաց խնդիր
OpenAI-ն պաշտոնապես ստեղծել է մաթեմատիկական խորհրդատվական խումբ՝ վերահսկելու առաջադեմ AI տրամաբանության ոլորտում իր հետազոտությունները: Այս քայլը հաջո…



