Մենք աուդիտի ենք ենթարկել AI օգտագործման 110 գործիք. Ահա թե որտեղ են սխալվում թվերը

AI օգտագործման 110 բաց կոդով գործիքների վերջին աուդիտը բացահայտել է զգալի անճշտություններ AI-ի սպառման չափման և հաշվարկման հարցում: Հետազոտությունը հայտնաբերել է 45 հաստատված սխալ հինգ կրկնվող կատեգորիաներում, ներառյալ հնացած գնացուցակները, սխալ քեշի բազմապատկիչները և հոսքային ագրեգացիայի թերությունները, որոնք հանգեցնում են կրկնակի հաշվարկի: Հետազոտողները պարզել են, որ որոշ գործիքներ սխալմամբ բացակայող տվյալները դիտարկում են որպես զրո, ինչը հանգեցնում է չարտոնված զեղչերի, մինչդեռ մյուսները տառապում են ժամանակային պատուհանների սխալներից: Աուդիտի արդյունքում կատարվել են 23 ուղղումներ, և ընդգծվել է առևտրային վաճառողների թափանցիկության պակասը, որոնք չունեն հաշիվ-ապրանքագրերի անհամապատասխանությունների վիճարկման ստանդարտացված գործընթացներ: Այս խնդիրները լուծելու համար հետազոտողները թողարկել են AgentMeasure բաց կոդով գործիքը, որը թույլ է տալիս օգտատերերին ինքնուրույն ստուգել իրենց AI օգտագործման տվյալները: Արդյունքները ընդգծում են հաշվետվողականության անհրաժեշտությունը, քանի որ AI-ի ընդունումը անցնում է ֆիքսված բաժանորդագրություններից դեպի թոքենների վրա հիմնված գնագոյացման:
This is a summary. Read the full article at the original source:
Dev.toԿապակցված
Կարո՞ղ է արդյոք Jev-ը լինել LLM-ների համար guard-մոդել
Հոդվածում վերլուծվում է մեծ լեզվական մոդելների (LLM) համար նախատեսված guard-մոդելների էվոլյուցիան: Հեղինակը նշում է, որ երկար ժամանակ SOTA լուծումներ…
Anthropic-ի և OpenAI-ի նոր մոդելները առաջնահերթություն են տալիս արդյունավետությանը և ծախսերի կրճատմանը
Anthropic-ը և OpenAI-ը ներկայացրել են արհեստական բանականության նոր մոդելներ, որոնք նախատեսված են աշխատանքի արդյունավետությունը բարձրացնելու և գործառնա…
48 ժամում արհեստական բանականության կողմից գրված կորպորատիվ համակարգի կլոնի կրաշ-թեստը
Այս հոդվածում հեղինակը փորձարկում է այն պնդումը, թե նեյրոնային ցանցերը կարող են ամբողջությամբ փոխարինել ծրագրավորողներին և մի քանի օրվա ընթացքում կլոն…



