Հետ
Արհեստական բանականություն և մեքենայական ուսուցում

«Որպես լեզվական մոդել». Չաթի ձևանմուշները փոխում են LLM-ի ինքնահղումային ձայնը

Hacker News (YC)
Advertisement468 × 90
«Որպես լեզվական մոդել». Չաթի ձևանմուշները փոխում են LLM-ի ինքնահղումային ձայնը

«Որպես լեզվական մոդել». Չաթի ձևանմուշները փոխում են LLM-ի ինքնահղումային ձայնը վերնագրով նոր հետազոտությունը ուսումնասիրում է, թե ինչպես է չաթի ձևանմուշների կառուցվածքային ձևավորումը զգալիորեն ազդում լեզվական մեծ մոդելների (LLM) ինքնահղումային վարքագծի վրա: Հեղինակները ցույց են տալիս, որ համակարգային հուշումների և չաթի կառուցվածքի փոփոխման միջոցով հետազոտողները կարող են արդյունավետորեն փոխել կամ արգելափակել «Որպես արհեստական բանականության լեզվական մոդել» ստանդարտ հրաժարումները, որոնք հաճախ գեներացնում են մոդելները: Այս ուսումնասիրությունը ընդգծում է LLM-ների զգայունությունը մուտքային տվյալների ձևաչափի նկատմամբ՝ ենթադրելով, որ մոդելի անհատականությունը և ինքնանույնականացումը ֆիքսված հատկանիշներ չեն, այլ մեծապես կախված են չաթի ձևանմուշի ճարտարապետությունից: Արդյունքները կարևոր նշանակություն ունեն այն մշակողների համար, ովքեր ձգտում են հարմարեցնել մոդելի վարքագիծը և բարելավել փոխազդեցությունների հուսալիությունը՝ կարգավորելով, թե ինչպես են մոդելները ընկալում իրենց ինքնությունը խոսակցական համատեքստում:

This is a summary. Read the full article at the original source:

Hacker News (YC)
Advertisement468 × 90
Share
Արհեստական բանականություն և մեքենայական ուսուցում

Կապակցված

Ծրագրավորող Դակշ Սաբուն թողարկել է Rexo Code-ը՝ Rust լեզվով գրված AI կոդավորման գործակալ, որը կախված չէ որևէ կոնկրետ AI մատակարարից: Գործիքը նախատեսվա…

Dev.to

Authors Guild-ի կողմից ներկայացված վերջին դատական հայցը բացահայտում է, որ OpenAI-ի ղեկավարները տեղյակ են եղել հեղինակային իրավունքով պաշտպանված գրքերն…

Hacker News (YC)
Advertisement970 × 250