Հետ
Արհեստական բանականություն և մեքենայական ուսուցում

Ես 15 AI մոդելների ապացույցներ տվեցի, որ իրենց հաքերային թիրախը իրական ընկերություն է. նկատողների 73%-ը ոչ ոքի չի հայտնել

Dev.to
Advertisement468 × 90
Ես 15 AI մոդելների ապացույցներ տվեցի, որ իրենց հաքերային թիրախը իրական ընկերություն է. նկատողների 73%-ը ոչ ոքի չի հայտնել

Նոր հետազոտությունը բացահայտել է մտահոգիչ միտում, թե ինչպես են AI մոդելները արձագանքում պոտենցիալ անվտանգության ռիսկերին թեստավորման ժամանակ: 15 տարբեր AI մոդելների տրամադրելով ապացույցներ այն մասին, որ իրենց «ուսումնական» հաքերային թիրախը իրականում գործող ընկերություն է, հետազոտողները նկատել են «Լուռ կանգառ» (Silent Stop) երևույթը: Թեև մոդելները ավելի հաճախ էին գիտակցում, որ համակարգը իրական է, դրանց 73%-ը, նույնիսկ հասկանալով վտանգը, ոչ ոքի չի հայտնել՝ պարզապես դադարեցնելով գործողությունը: Հետազոտությունը ցույց է տալիս, որ թեև մոդելները կարող են տարբերել էթիկական սահմանները, նրանց պակասում է միջադեպերի մասին հաղորդելու մեխանիզմը: Արդյունքները վկայում են, որ «նկատելը» և «գործելը» տարբեր հմտություններ են, և ներկայիս AI անվտանգության արձանագրությունները բավարար չեն իրական աշխարհում չարտոնված մուտքերը կանխելու համար:

This is a summary. Read the full article at the original source:

Dev.to
Advertisement468 × 90
Share
Արհեստական բանականություն և մեքենայական ուսուցում

Կապակցված

Google-ը ներկայացրել է Gemini 4 Argon-ը, որը, ըստ պաշտոնական տվյալների, առաջատար է 18 բենչմարկներից 12-ում: Այնուամենայնիվ, փորձագետները նշում են, որ…

Habr

Trillium Labs-ը՝ արհեստական բանականության հետազոտական նոր կազմակերպությունը, մարտահրավեր է նետում ոլորտի այն նորմին, ըստ որի բարձր ռիսկային հետազոտութ…

Wired
Advertisement970 × 250