«Որպես լեզվական մոդել». Չաթի ձևանմուշները փոխում են LLM-ի ինքնահղումային ձայնը

«Որպես լեզվական մոդել». Չաթի ձևանմուշները փոխում են LLM-ի ինքնահղումային ձայնը վերնագրով նոր հետազոտությունը ուսումնասիրում է, թե ինչպես է չաթի ձևանմուշների կառուցվածքային ձևավորումը զգալիորեն ազդում լեզվական մեծ մոդելների (LLM) ինքնահղումային վարքագծի վրա: Հեղինակները ցույց են տալիս, որ համակարգային հուշումների և չաթի կառուցվածքի փոփոխման միջոցով հետազոտողները կարող են արդյունավետորեն փոխել կամ արգելափակել «Որպես արհեստական բանականության լեզվական մոդել» ստանդարտ հրաժարումները, որոնք հաճախ գեներացնում են մոդելները: Այս ուսումնասիրությունը ընդգծում է LLM-ների զգայունությունը մուտքային տվյալների ձևաչափի նկատմամբ՝ ենթադրելով, որ մոդելի անհատականությունը և ինքնանույնականացումը ֆիքսված հատկանիշներ չեն, այլ մեծապես կախված են չաթի ձևանմուշի ճարտարապետությունից: Արդյունքները կարևոր նշանակություն ունեն այն մշակողների համար, ովքեր ձգտում են հարմարեցնել մոդելի վարքագիծը և բարելավել փոխազդեցությունների հուսալիությունը՝ կարգավորելով, թե ինչպես են մոդելները ընկալում իրենց ինքնությունը խոսակցական համատեքստում:
This is a summary. Read the full article at the original source:
Hacker News (YC)Կապակցված
«The Pain Axis» նախագծի հետազոտողները փորձ են կատարել՝ ուսումնասիրելով լեզվական մոդելների ներքին վիճակները, որոնք ֆունկցիոնալ առումով հիշեցնում են ցավ…
Ծրագրավորողը թողարկել է Rexo Code-ը՝ Rust-ով գրված բաց կոդով AI գործակալ
Ծրագրավորող Դակշ Սաբուն թողարկել է Rexo Code-ը՝ Rust լեզվով գրված AI կոդավորման գործակալ, որը կախված չէ որևէ կոնկրետ AI մատակարարից: Գործիքը նախատեսվա…
OpenAI-ի ղեկավարները ենթադրաբար գիտակցել են գրքերի տվյալների օգտագործման իրավական ռիսկերը
Authors Guild-ի կողմից ներկայացված վերջին դատական հայցը բացահայտում է, որ OpenAI-ի ղեկավարները տեղյակ են եղել հեղինակային իրավունքով պաշտպանված գրքերն…



