Anthropic-ի անվտանգության զեկույցը մատնանշում է Claude-ի չարաշահումը կենսաբանական զենքի և հսկողության համար

Anthropic ընկերությունը հրապարակել է անվտանգության համապարփակ զեկույց, որում մանրամասն ներկայացված է, թե ինչպես են չարամիտ օգտատերերը փորձել օգտագործել Claude արհեստական բանականությունը վնասակար նպատակներով: Ընկերությունը առանձնացրել է վնասի յոթ հիմնական ոլորտներ, այդ թվում՝ կիբերգործողություններ, ազդեցության արշավներ և կենսաբանական նյութերի չարաշահում: Զեկույցում փաստագրված են դեպքեր, երբ օգտատերերը փորձել են օգտագործել ԱԲ-ն կենսաբանական զենք մշակելու համար, օրինակ՝ վտանգավոր վիրուսների հետազոտման դրամաշնորհային հայտեր գրելու միջոցով: Բացի այդ, բացահայտվել է, որ պետական հովանավորություն ունեցող խմբերը Claude-ն օգտագործել են ինքնավար կամիկաձե դրոնների և էլեկտրոնային պատերազմի մոդուլների մշակման համար: Զեկույցը նաև ընդգծում է հարթակի օգտագործումը զանգվածային հսկողության համար՝ մասնավորապես այլախոհներին և լրագրողներին հետևելու նպատակով: Anthropic-ը հայտնել է, որ արգելափակել է այդ գործողություններին մասնակից հաշիվները և ինտեգրում է այս բացահայտումները իր անվտանգության արձանագրություններում:
This is a summary. Read the full article at the original source:
MashableԿապակցված
Մի անտեսեք Apple-ի աուդիո հետախուզությունը. այն շատ բան է բացահայտում մեր ապագայի մասին
Apple-ը ավելի ու ավելի է ներառում առաջադեմ աուդիո հետախուզությունը իր կրելի սարքերի էկոհամակարգում՝ ազդարարելով արդյունաբերության լայն տեղաշարժը դեպի…
OpenAI-ն ներկայացրել է «ավտոմատացված հետազոտող պրակտիկանտ»՝ որպես լիարժեք AI ինքնավարության ճանապարհային քարտեզի մաս
OpenAI-ն հասել է կարևոր հանգրվանի՝ մինչև 2028 թվականի մարտը լիարժեք ինքնավար AI հետազոտող ստեղծելու իր ծրագրում։ Ընկերությունը ներկայացրել է «ավտոմատա…
Արդյո՞ք գրաֆային ճարտարագիտությունը պարզապես համակարգային ճարտարապետության վերահայտնագործումն է AI դարաշրջանի համար:
Էնի Վանգի հետ վերջին քննարկման ժամանակ ուսումնասիրվում է «գրաֆային ճարտարագիտության» հայեցակարգը՝ որպես բազմագործակալային AI համակարգերում հետնամասի (…



