Հետ
Արհեստական բանականություն և մեքենայական ուսուցում

Speculative Decoding-ը vLLM-ում AMD GPU-ների համար

Hacker News (YC)
Advertisement468 × 90
Speculative Decoding-ը vLLM-ում AMD GPU-ների համար

vLLM նախագիծը հայտարարել է AMD GPU-ների վրա speculative decoding-ի պաշտոնական աջակցության մասին, ինչը կարևոր քայլ է բաց կոդով լեզվական մոդելների (LLM) ինֆերենսի համար: Speculative decoding-ը տեխնիկա է, որը նախատեսված է արագացնելու LLM-ների աշխատանքը՝ օգտագործելով ավելի փոքր և արագ մոդել՝ հաջորդականությունները կանխատեսելու համար, որոնք այնուհետև ստուգվում են հիմնական մոդելի կողմից: Այս օպտիմալացումը AMD-ի ROCm էկոհամակարգին հարմարեցնելով՝ vLLM-ը թույլ է տալիս մշակողներին հասնել ավելի բարձր արդյունավետության և ցածր ուշացման՝ ոչ NVIDIA սարքավորումների վրա: Այս թարմացումը լրացնում է AI ենթակառուցվածքների կարևոր բացը՝ հնարավորություն տալով ավելի արդյունավետ կերպով տեղակայել գեներատիվ AI մոդելները AMD-ի հիմքով կլաստերներում: Այս զարգացումը կընդլայնի բարձր արդյունավետությամբ AI գործիքների հասանելիությունը այն հետազոտողների և ձեռնարկությունների համար, որոնք օգտագործում են տարբեր սարքավորումային լուծումներ:

This is a summary. Read the full article at the original source:

Hacker News (YC)
Advertisement468 × 90
Share
Արհեստական բանականություն և մեքենայական ուսուցում

Կապակցված

Meta-ն ներկայացրել է իր վերջին նորարարությունը՝ Muse AI գործակալը, որը նախատեսված է որպես օգտատերերի համար խիստ անհատականացված օգնական հանդես գալու հա…

CNET

OpenAI-ը վերջերս հայտարարել է մաթեմատիկայի ոլորտում նշանակալի առաջընթացի մասին, որը վերաբերում է Նավիե-Ստոքսի հավասարումներին, որոնք նկարագրում են հեղ…

Engadget

OpenReview-ում հրապարակված վերջին գիտական աշխատանքը ուսումնասիրում է, թե ինչպես կարող են խոշոր լեզվական մոդելները (LLM) ձեռք բերել և դրսևորել նոր սոցի…

Hacker News (YC)
Advertisement970 × 250