Հետազոտողները օգտագործել են Claude-ը OpenAI-ը կոտրելու համար

Կիբերանվտանգության հետազոտողների խումբը հաջողությամբ ցուցադրել է OpenAI-ի համակարգերում առկա խոցելիությունը՝ օգտագործելով Anthropic-ի Claude արհեստական բանականությունը: Հետազոտողները, մասնակցելով խոցելիության բացահայտման պաշտոնական ծրագրին, ստացել են OpenAI-ի աշխատակցի ChatGPT հաշվի հասանելիությունը: Այս ներթափանցումը նրանց թույլ է տվել դիտել մասնավոր ծրագրային տեղեկատվություն և առաջարկել կոդի փոփոխություններ: Գործողությունը հնարավոր է դարձել Anthropic-ի գործիքի միջոցով, որը նախատեսված է անվտանգության մասնագետների համար՝ AI մոդելներում թույլ կողմերը հայտնաբերելու նպատակով: Այս միջադեպը ընդգծում է հակառակորդի տեխնոլոգիաների կիրառմամբ թեստավորման կարևորությունը, քանի որ առաջատար AI ընկերությունները բախվում են իրենց հարթակների անվտանգության վերաբերյալ աճող վերահսկողությանը: OpenAI-ը շարունակում է համագործակցել անվտանգության փորձագետների հետ՝ այս խոցելիությունները վերացնելու և չարամիտ գործողություններից պաշտպանվելու համար՝ ընդգծելով ժամանակակից կիբերանվտանգության հետազոտությունների համագործակցային բնույթը:
This is a summary. Read the full article at the original source:
Ars TechnicaԿապակցված
Ինչպե՞ս կարող են AI գործակալները հանգեցնել ձեռնարկությունների համար անվերահսկելի ծախսերի
Քանի որ ձեռնարկություններն ավելի ու ավելի են ինտեգրում ինքնավար AI գործակալներն իրենց աշխատանքային գործընթացներում, ի հայտ է եկել ֆինանսական լուրջ ռիս…
AI-ի անվերահսկելի վտանգները կանխելու համար անհրաժեշտ է ավելին, քան պարզապես խոսակցություններ P(doom)-ի մասին
CNET-ի հյուրընկալված սյունակում հեղինակ Ջեյմի Բարթլեթը քննարկում է առաջադեմ արհեստական բանականության հետ կապված աճող ռիսկերը: Բարթլեթը պնդում է, որ «P…
OpenAI-ն ստեղծում է մաթեմատիկական խորհրդատվական խումբ, քանի որ նրա AI-ն լուծել է ավելի քան 100 բաց խնդիր
OpenAI-ն պաշտոնապես ստեղծել է մաթեմատիկական խորհրդատվական խումբ՝ վերահսկելու առաջադեմ AI տրամաբանության ոլորտում իր հետազոտությունները: Այս քայլը հաջո…



