Հետ
Արհեստական բանականություն և մեքենայական ուսուցում

Ի՞նչ է «internal OpenAI model»-ը և ինչո՞ւ է DeepSeek-ը հասնում OpenAI-ին

Habr
Advertisement468 × 90
Ի՞նչ է «internal OpenAI model»-ը և ինչո՞ւ է DeepSeek-ը հասնում OpenAI-ին

Հոդվածում վերլուծվում է AI լաբորատորիաների «ներքին» մոդելների բնույթը և դրանց մշակման գործընթացը: Հեղինակը հերքում է գաղտնի AGI-ի մասին դավադրության տեսությունները՝ բացատրելով, որ խոշոր ընկերությունները ստեղծում են մոդելների մի ամբողջ էկոհամակարգ՝ հետազոտական ստուգումներից մինչև դիստիլացված արտադրական տարբերակներ: Հիմնական շեշտը դրված է գիտելիքի դիստիլացման գործընթացի վրա, երբ հզոր ուսուցիչ-մոդելներն օգտագործվում են ավելի կոմպակտ և արդյունավետ ուսանող-մոդելներ պատրաստելու համար: Սա թույլ է տալիս OpenAI-ի նման ընկերություններին օպտիմալացնել հաշվողական հզորության, արժեքի և արձագանքման արագության հավասարակշռությունը վերջնական օգտատերերի համար: Հեղինակը շեշտում է, որ հետազոտական և արտադրական մոդելները հետապնդում են տարբեր նպատակներ. առաջինները առավելագույնի են հասցնում հնարավորությունները, իսկ երկրորդները հավասարակշռում են ինտելեկտը, ուշացումը և GPU-ի արժեքը: Օպտիմալացման և մասշտաբավորման այս մոտեցումը բացատրում է, թե ինչու են մրցակիցները, ներառյալ DeepSeek-ը, կարողանում արագ կրճատել տեխնոլոգիական բացը՝ արդյունավետորեն օգտագործելով սինթետիկ տվյալների վրա ուսուցման և դիստիլացման մեթոդները:

This is a summary. Read the full article at the original source:

Habr
Advertisement468 × 90
Share
Արհեստական բանականություն և մեքենայական ուսուցում

Կապակցված

Արհեստական բանականության ոլորտի առաջատար դեմքերը, այդ թվում՝ OpenAI-ի, Anthropic-ի և Google DeepMind-ի ղեկավարները, վերջերս քննարկել են AI-ի զարգացման…

The Verge

Apple-ի Siri AI-ի առաջիկա թարմացումների վերաբերյալ վերջին արտահոսքը վկայում է ձայնային օգնականի աշխատանքի էական փոփոխության մասին: Ըստ հաղորդագրությու…

CNET

Anthropic-ի գործադիր տնօրեն Դարիո Ամոդեյը վերջերս նշանակալի բանավեճ հրահրեց արհեստական բանականության ապագայի վերաբերյալ՝ հրապարակելով «Մենք պետք է դան…

The Verge
Advertisement970 × 250