Ես 397B մոդելը վերածեցի 4B-ի 1.60 դոլարով. Այն այժմ բռնում է արշավը կանգնեցնող 33 զգուշացումներից 28-ը

Ծրագրավորող Սումյա Դեյը ցույց է տվել լեզվական մեծ մոդելների դիստիլյացիայի ծախսարդյունավետ մեթոդ՝ հաջողությամբ սեղմելով 397B պարամետր ունեցող մոդելի հնարավորությունները 4B պարամետր ունեցող տարբերակի մեջ ընդամենը 1.60 դոլարով։ «TrailTruth» կոչվող նախագիծը օգտագործում է LoRA ճշգրտման մոտեցումը Qwen3.5-4B-ի վրա՝ Ազգային պարկերի ծառայության ծանուցումները վերլուծելու համար։ Փոքր մոդելը մարզելով ավելի մեծ ուսուցիչ մոդելի կողմից ստեղծված և պաշտոնական ռեյնջերների կատեգորիաներով ուղղված պիտակների վրա՝ 4B մոդելը զգալիորեն բարելավել է իր արդյունավետությունը արշավային արահետների փակման վերաբերյալ։ Այն հաջողությամբ բացահայտել է 33 «արգելված» ծանուցումներից 28-ը՝ բազային մոդելի 17-ի դիմաց։ Համակարգը գործում է որպես շաբաթական ավտոմատացված աշխատանքային հոսք, որը ստեղծում է պարզ, տպագրվող քարտ արշավականների համար՝ օգնելով նրանց խուսափել ավելորդ ռիսկերից՝ առանց կառավարական հազարավոր բառեր կարդալու։ Նախագիծը լիովին բաց կոդով է՝ ընդգծելով փոքր, առաջադրանքին հատուկ մոդելների արդյունավետությունը իրական կիրառություններում։
This is a summary. Read the full article at the original source:
Dev.toԿապակցված
8 AI ծառայություններ Reels և Shorts-ի համար. ի՞նչ է աշխատում 2026 թվականին
Հոդվածում հեղինակը կիսվում է Reels և Shorts-ի համար կարճ ուղղահայաց տեսանյութերի մոնտաժման գործընթացը օպտիմալացնելու իր անձնական փորձով: Նախկինում ժամ…
13-ից 12 AI մոդելներ գիտեին նոր անունը, բայց միևնույն է՝ գրեցին հինը
Kaggle-ում անցկացված «Semconv Drift» անվանումով վերջին հետազոտությունը փորձարկել է 17 AI մոդելների ունակությունը՝ ստեղծելու ճշգրիտ OpenTelemetry գործի…
Հեղինակը շարունակում է տեսակոնֆերանսների համար տեղային օգնականի մշակման մասին հոդվածների շարքը։ Տասներորդ մասում քննարկվում է հանդիպումների համատեքստը…


