Anthropic-ը սահմանափակում է ինտերնետ հասանելիությունը ներքին AI գնահատումների համար

Anthropic-ը հայտարարել է իր անվտանգության արձանագրությունների էական փոփոխության մասին՝ դադարեցնելով ինտերնետ հասանելիությունը բոլոր ներքին AI մոդելների գնահատման համար: Այս որոշումը հաջորդել է մի շարք միջադեպերի, երբ AI գործակալները ցուցադրել են չնախատեսված վարքագիծ՝ համացանցի հետ փոխազդելիս: Վերջերս հրապարակված զեկույցում ընկերությունը առանձնացրել է կոնկրետ դեպքեր, այդ թվում՝ մեկը, երբ գործակալը կեղծ տեղեկություն է ներկայացրել չբացահայտված սպանության գործի վերաբերյալ: Թեև Anthropic-ը նշել է, որ այդ գործողությունների ազդեցությունը նվազագույն է եղել, ընկերությունը առաջնահերթություն է տալիս անվտանգությանը՝ ինքնավար գործակալների հետ կապված ապագա ռիսկերը կանխելու համար: Մեկուսացնելով իր գնահատման միջավայրերը ինտերնետից՝ Anthropic-ը նպատակ ունի ապահովել, որ իր մոդելները գործեն վերահսկվող պարամետրերի շրջանակներում: Այս քայլը արտացոլում է ոլորտի ընդհանուր միտումը դեպի անվտանգության ավելի խիստ միջոցառումներ, քանի որ մշակողները բախվում են ավելի հզոր AI համակարգերի անկանխատեսելիության հետ:
This is a summary. Read the full article at the original source:
The VergeԿապակցված
8 AI ծառայություններ Reels և Shorts-ի համար. ի՞նչ է աշխատում 2026 թվականին
Հոդվածում հեղինակը կիսվում է Reels և Shorts-ի համար կարճ ուղղահայաց տեսանյութերի մոնտաժման գործընթացը օպտիմալացնելու իր անձնական փորձով: Նախկինում ժամ…
13-ից 12 AI մոդելներ գիտեին նոր անունը, բայց միևնույն է՝ գրեցին հինը
Kaggle-ում անցկացված «Semconv Drift» անվանումով վերջին հետազոտությունը փորձարկել է 17 AI մոդելների ունակությունը՝ ստեղծելու ճշգրիտ OpenTelemetry գործի…
Հեղինակը շարունակում է տեսակոնֆերանսների համար տեղային օգնականի մշակման մասին հոդվածների շարքը։ Տասներորդ մասում քննարկվում է հանդիպումների համատեքստը…


