Հետ
Արհեստական բանականություն և մեքենայական ուսուցում

Ես 397B մոդելը վերածեցի 4B-ի 1.60 դոլարով. Այն այժմ բռնում է արշավը կանգնեցնող 33 զգուշացումներից 28-ը

Dev.to
Advertisement468 × 90
Ես 397B մոդելը վերածեցի 4B-ի 1.60 դոլարով. Այն այժմ բռնում է արշավը կանգնեցնող 33 զգուշացումներից 28-ը

Ծրագրավորող Սումյա Դեյը ցույց է տվել լեզվական մեծ մոդելների դիստիլյացիայի ծախսարդյունավետ մեթոդ՝ հաջողությամբ սեղմելով 397B պարամետր ունեցող մոդելի հնարավորությունները 4B պարամետր ունեցող տարբերակի մեջ ընդամենը 1.60 դոլարով։ «TrailTruth» կոչվող նախագիծը օգտագործում է LoRA ճշգրտման մոտեցումը Qwen3.5-4B-ի վրա՝ Ազգային պարկերի ծառայության ծանուցումները վերլուծելու համար։ Փոքր մոդելը մարզելով ավելի մեծ ուսուցիչ մոդելի կողմից ստեղծված և պաշտոնական ռեյնջերների կատեգորիաներով ուղղված պիտակների վրա՝ 4B մոդելը զգալիորեն բարելավել է իր արդյունավետությունը արշավային արահետների փակման վերաբերյալ։ Այն հաջողությամբ բացահայտել է 33 «արգելված» ծանուցումներից 28-ը՝ բազային մոդելի 17-ի դիմաց։ Համակարգը գործում է որպես շաբաթական ավտոմատացված աշխատանքային հոսք, որը ստեղծում է պարզ, տպագրվող քարտ արշավականների համար՝ օգնելով նրանց խուսափել ավելորդ ռիսկերից՝ առանց կառավարական հազարավոր բառեր կարդալու։ Նախագիծը լիովին բաց կոդով է՝ ընդգծելով փոքր, առաջադրանքին հատուկ մոդելների արդյունավետությունը իրական կիրառություններում։

This is a summary. Read the full article at the original source:

Dev.to
Advertisement468 × 90
Share
Արհեստական բանականություն և մեքենայական ուսուցում

Կապակցված

Հոդվածում հեղինակը կիսվում է Reels և Shorts-ի համար կարճ ուղղահայաց տեսանյութերի մոնտաժման գործընթացը օպտիմալացնելու իր անձնական փորձով: Նախկինում ժամ…

Habr
Advertisement970 × 250