Anthropic-ը հայտնում է, որ օգտատերերը փորձել են շրջանցել AI-ի պաշտպանիչ մեխանիզմները կենսաբանական զենքի հետազոտությունների համար

Anthropic ընկերությունը հայտարարել է, որ հաջողությամբ կանխել է օգտատերերի բազմաթիվ փորձեր՝ օգտագործելու իր AI մոդելները կենսաբանական զենքի մշակման հետ կապված հետազոտությունների համար: Վերջերս հրապարակված զեկույցում ստարտափը մանրամասնել է հինգ դեպք, երբ անհատները օգտագործել են քողարկման մեթոդներ և շրջանցել անվտանգության վերահսկողությունը՝ համակարգից սահմանափակված տեղեկատվություն ստանալու համար: Այս փորձերը կատարվել են տարբեր վայրերից, այդ թվում՝ այն երկրներից, որոնց մուտքը Anthropic-ի տեխնոլոգիաներ արգելված է, ինչպիսիք են Ռուսաստանը, Չինաստանը և Իրանը: Ընկերությունը շեշտել է, որ այս միջադեպերը ընդգծում են գեներատիվ AI-ի չարաշահման հետ կապված աճող ռիսկերը զգայուն գիտական ոլորտներում: Կիսվելով այս բացահայտումներով՝ Anthropic-ը նպատակ ունի խթանել ավելի լայն երկխոսություն AI ոլորտի և կառավարական մարմինների միջև՝ կենսաբանական սպառնալիքների նվազեցման վերաբերյալ: Զեկույցը կոչ է տեխնոլոգիական ոլորտին՝ ուժեղացնել անվտանգության արձանագրությունները և բարելավել մոնիտորինգի հնարավորությունները՝ առաջադեմ արհեստական բանականության զենքի վերածումը կանխելու համար:
This is a summary. Read the full article at the original source:
Ars TechnicaԿապակցված
Արհեստական բանականության արագ զարգացման դարաշրջանում կոդ գրելու արժեքը նվազում է, ինչը որակյալ ինժեներական նախագծումը դարձնում է առանցքային հմտություն…
Արհեստական բանականության ամենախիստ քննադատներից մեկը պնդում է, որ «կործանման» մասին խոսակցությունները նպատակ ունեն շեղել մեր ուշադրությունը
Արհեստական բանականության ոլորտի հայտնի հետազոտող Թիմնիթ Գեբրուն պնդում է, որ արդյունաբերության կողմից գոյաբանական ռիսկերի և «ԱԲ-ի կործանման» վրա կենտր…
AI-ի «տրամաբանական» հետքերի մեծ մասը պարզապես պատասխանն է՝ հակառակ գրված
Վերջերս անցկացված հետազոտությունը ուսումնասիրում է ժամանակակից AI մոդելներում «մտքի շղթայի հավատարմության» հայեցակարգը՝ կասկածի տակ դնելով, թե արդյոք…



