Գործակալները չեն կարողանում տարբերել անվտանգ և վտանգավոր գործողությունները

Dev.to-ում հրապարակված վերջին հոդվածը ընդգծում է ինքնավար AI գործակալների խոցելիությունը՝ նրանց անկարողությունը՝ գիտակցելու իրենց գործողությունների հետևանքները: Մինչ մարդիկ ունեն ռիսկի ինտուիտիվ զգացում, AI գործակալները ինտերֆեյսի բոլոր գործողությունները դիտարկում են որպես հավասարազոր առաջադրանքներ: Քանի որ այս գործակալները գործում են օրինաչափությունների, այլ ոչ թե ազդեցության գիտակցման հիման վրա, նրանք կարող են պատահաբար կատարել աղետալի հրամաններ, օրինակ՝ ջնջել տվյալների բազան: Հեղինակը պնդում է, որ գործակալի «դատողության» վրա հույս դնելը բավարար չէ: Փոխարենը, մշակողները պետք է ներդնեն կառուցվածքային պաշտպանիչ մեխանիզմներ, ներառյալ թույլտվությունների խիստ համակարգեր և մարդկային հաստատման պարտադիր ընթացակարգեր զգայուն գործողությունների համար: Քանի որ AI գործակալները ստանում են ավելի լայն հասանելիություն դեպի կորպորատիվ գործիքներ, ոլորտը պետք է կենտրոնանա ոչ թե գործակալների ինտելեկտի բարելավման, այլ անվտանգ համակարգերի ստեղծման վրա՝ կանխելու համար չվերահսկվող, բարձր ռիսկային գործողությունները:
This is a summary. Read the full article at the original source:
Dev.toԿապակցված
BotHub նեյրոնային ցանցերի ագրեգատորի հիմնադիրը կիսվում է ժամանակակից լեզվական մոդելների մասնագիտացման վերաբերյալ իր դիտարկումներով: Չնայած տրանսֆորմեր…
Իմ prompt-injection-ի պաշտպանությունը բաց թողեց 20 հարձակումներից 0-ը. այն մասը, որը գրեթե չէի կառուցել, բռնեց բոլորը
Ծրագրավորող Վիշալ Հաբիբը կիսվել է AI-ի կողմից ստեղծված կենսաթոշակային խորհրդատվության համար անվտանգության ստուգիչ ստեղծելու իր փորձով: Համակարգը օգտագ…
Dev.to-ում հրապարակված հոդվածում ծրագրավորողը մանրամասնում է FORGE-ի՝ AI գործակալների համակարգի ստեղծումը, որը նախատեսված է հետազոտական խնդիրներ լուծե…



