TypeSafe Jev-ը շախմատ է խաղացել և հայտնվել տրամաբանող մոդելների կողքին

Ծրագրավորող Մաքսիմ Սապլինը TypeSafe-ի Jev մոդելը ներառել է իր LLM Chess առաջատարների աղյուսակում՝ այն փորձարկելու ավանդական չաթ-բոտերի դեմ։ Ի տարբերություն ստանդարտ մոդելների, Jev-ը «System One» տիպի մոդել է, որը նախատեսված է կառուցվածքային առաջադրանքների համար՝ ընտրելով նախապես սահմանված տարբերակներից։ Շախմատային քայլերը որպես դասակարգման խնդիր դիտարկելով՝ Սապլինը հնարավորություն է տվել Jev-ին խաղալ ամբողջական պարտիաներ։ Արդյունքները տպավորիչ են. Jev-ը ցույց է տվել տրամաբանող մոդելներին համարժեք Elo վարկանիշ՝ լինելով շատ ավելի արագ և էժան (մեկ խաղի համար՝ $0.0015)։ Թեև Jev-ը դժվարանում է գեներատիվ առաջադրանքներում, որոշումների կայացման նրա արդյունավետությունը այն դարձնում է հզոր գործիք կառուցվածքային գործակալային համակարգերի համար։ Այս փորձը ցույց է տալիս, որ մասնագիտացված մոդելները կարող են մրցակցել ավելի մեծ մոդելների հետ՝ առաջարկելով բարձր արդյունավետություն ավտոմատացված որոշումների կայացման համակարգերում։
This is a summary. Read the full article at the original source:
Dev.toԿապակցված
Ինչպե՞ս կարող են AI գործակալները հանգեցնել ձեռնարկությունների համար անվերահսկելի ծախսերի
Քանի որ ձեռնարկություններն ավելի ու ավելի են ինտեգրում ինքնավար AI գործակալներն իրենց աշխատանքային գործընթացներում, ի հայտ է եկել ֆինանսական լուրջ ռիս…
AI-ի անվերահսկելի վտանգները կանխելու համար անհրաժեշտ է ավելին, քան պարզապես խոսակցություններ P(doom)-ի մասին
CNET-ի հյուրընկալված սյունակում հեղինակ Ջեյմի Բարթլեթը քննարկում է առաջադեմ արհեստական բանականության հետ կապված աճող ռիսկերը: Բարթլեթը պնդում է, որ «P…
OpenAI-ն ստեղծում է մաթեմատիկական խորհրդատվական խումբ, քանի որ նրա AI-ն լուծել է ավելի քան 100 բաց խնդիր
OpenAI-ն պաշտոնապես ստեղծել է մաթեմատիկական խորհրդատվական խումբ՝ վերահսկելու առաջադեմ AI տրամաբանության ոլորտում իր հետազոտությունները: Այս քայլը հաջո…



