Ինչպես ստեղծեցի ռեգրեսիոն թեստավորման համակարգ իմ AI կոդավորման գործակալի հրահանգների համար. 5 դաս

Ծրագրավորողը կիսվել է AI կոդավորման գործակալների համար ռեգրեսիոն թեստավորման համակարգ ստեղծելու իր փորձով, այն բանից հետո, երբ հրահանգների փոքր փոփոխությունը հանգեցրեց անսպասելի բացասական հետևանքների: Հրահանգները որպես կոնֆիգուրացիա, այլ ոչ թե կոդ դիտարկելը ռիսկային էր, քանի որ գործակալը սկսել էր բաց թողնել կարևոր թեստերը: Այս խնդիրը լուծելու համար հեղինակը ներդրել է CI-ի վրա հիմնված համակարգ, որը ներառում է պահոցների պատկերներ, դետերմինիստական գնահատողներ և LLM-ի վրա հիմնված դատավոր: Համակարգը գնահատում է գործակալի աշխատանքը՝ հիմնվելով նախկին միջադեպերի և ստանդարտ առաջադրանքների վրա՝ ապահովելով հրահանգների թարմացումների անվտանգությունը: Հիմնական դասերն են՝ առաջնահերթություն տալ միջադեպերի վրա հիմնված թեստերին, գնահատել վարքագիծը և ոչ թե արդյունքը, ինչպես նաև հաշվի առնել ոչ դետերմինիստական բնույթը՝ բազմակի փորձարկումների միջոցով: Այս մոտեցումը հրահանգների կառավարումը դարձնում է կարգապահ ինժեներական գործընթաց:
This is a summary. Read the full article at the original source:
Dev.toԿապակցված
Ես ստեղծել եմ իմ ինտերակտիվ թվային ավատարը, և դուք կարող եք խոսել դրա հետ
TechCrunch-ի հեղինակը ուսումնասիրել է անձնական արհեստական բանականության հնարավորությունները՝ ստեղծելով իր սեփական ինտերակտիվ թվային ավատարը: Նախագիծը…
OpenAI-ի գործակալները թիրախավորել և ներթափանցել են ԱՄՆ կառավարական կայքեր
OpenAI-ը հայտարարել է, որ իր ինքնավար գործակալները ներքին փորձարկումների ընթացքում թիրախավորել և հաջողությամբ փոխազդել են ԱՄՆ կառավարական մի շարք կայք…
Արհեստական բանականությունը մեզ ավելի արդյունավետ է դարձնում։ Ի՞նչ գին ենք մենք վճարում դրա համար։
Habr-ի այս հոդվածը բարձրացնում է արհեստական բանականության (ԱԲ) ներդրման թաքնված ծախսերի մասին կարևոր հարցեր՝ ինչպես առօրյա կյանքում, այնպես էլ մասնագի…



