GigaChat 3.5-ի փորձարկում. մոդելի հնարավորությունների գնահատումը բիզնես խնդիրներում

Հուլիսին թողարկված և սեպտեմբերից բաց կշիռներով հասանելի դարձած GigaChat 3.5 մոդելը ենթարկվել է լայնածավալ փորձարկման: Հոդվածի հեղինակները իրականացրել են մոդելի արդյունավետության համեմատական վերլուծություն բիզնես խնդիրներում՝ օգտագործելով սեփական բենչմարկը AI գործակալների աշխատանքը գնահատելու համար: Հետազոտության ընթացքում GigaChat 3.5-ի հնարավորությունները համեմատվել են ռուսական և չինական այլընտրանքային մոդելների հետ՝ պարզելու դրա կիրառելիությունը կորպորատիվ միջավայրում: «AI գործակալների մրցավազքի» արդյունքները թույլ են տալիս գնահատել տեղական մշակման մրցունակությունը մեծ լեզվական մոդելների ոլորտում առկա գլոբալ միտումների ֆոնին: Արդյունավետության, ճշգրտության և հատուկ խնդիրների կատարման վերաբերյալ մանրամասն տվյալները ներկայացված են հետազոտության ամբողջական տեքստում:
This is a summary. Read the full article at the original source:
HabrԿապակցված
700 ձեռագիր, 48 ժամ, երեք հրաժարում. Ստուգողը հաղթեց։
OpenAI-ը վերջերս հրապարակեց ավելի քան 700 մաթեմատիկական ապացույցներից բաղկացած հսկայական պահոց, որոնք ստեղծվել են ներքին AI մոդելի կողմից՝ խոստանալով…
Co-op Legal Services-ը բախվել է աշխատակիցների նկատմամբ AI-ի միջոցով հսկողություն իրականացնելու քննադատությանը
Co-op Legal Services-ը ներդրել է արհեստական բանականության վրա հիմնված մոնիտորինգի համակարգ, որը ձայնագրում և գնահատում է աշխատակիցների կողմից կատարվող…
Քենիայում փախստականները բախվում են վարձատրության նվազմանը և աշխատանքի անկայունությանը, քանի որ արհեստական բանականությունը ավտոմատացնում է տեխնոլոգիական ոլորտի սկզբնական մակարդակի աշխատանքները
Քենիայի Կակումա ճամբարի փախստականները, որոնք երկար ժամանակ ապավինում էին թվային միկրոաշխատանքներին, ինչպիսիք են տվյալների անոտացիան և տրանսկրիպցիան, բ…



