Հետ
Արհեստական բանականություն և մեքենայական ուսուցում

Docling. Փոխակերպեք խառը փաստաթղթերը ձեր AI հավելվածի համար մաքուր տվյալների

Dev.to
Advertisement468 × 90
Docling. Փոխակերպեք խառը փաստաթղթերը ձեր AI հավելվածի համար մաքուր տվյալների

Docling-ը բաց կոդով Python գրադարան է, որը մշակվել է IBM Research-ի կողմից և հյուրընկալվում է LF AI & Data Foundation-ի կողմից: Այն նախատեսված է բարդ փաստաթղթերը Markdown, HTML կամ JSON ձևաչափերի վերածելու համար: Լուծելով PDF-ներից, Word ֆայլերից և պատկերներից մաքուր տվյալներ կորզելու խնդիրը՝ Docling-ը օգտագործում է մեքենայական ուսուցում՝ դասավորությունը, ընթերցման հերթականությունը և աղյուսակները ճիշտ ճանաչելու համար: Այն աջակցում է տարբեր մուտքային ձևաչափեր և հեշտությամբ ինտեգրվում է LangChain-ի և LlamaIndex-ի նման շրջանակների հետ: Քանի որ այն աշխատում է տեղային մակարդակով, այն իդեալական է զգայուն տվյալների մշակման համար՝ առանց արտաքին API-ների անհրաժեշտության: Թեև այն պահանջում է ավելի շատ հաշվողական ռեսուրսներ, քան պարզ տեքստային էքստրակտորները, այն առաջարկում է հզոր լուծում մշակողների համար, ովքեր պետք է անկազմակերպ փաստաթղթերը վերածեն բարձրորակ տվյալների՝ AI աշխատանքային հոսքերի համար:

This is a summary. Read the full article at the original source:

Dev.to
Advertisement468 × 90
Share
Արհեստական բանականություն և մեքենայական ուսուցում

Կապակցված

Քանի որ ձեռնարկություններն ավելի ու ավելի են ինտեգրում ինքնավար AI գործակալներն իրենց աշխատանքային գործընթացներում, ի հայտ է եկել ֆինանսական լուրջ ռիս…

Dark Reading

CNET-ի հյուրընկալված սյունակում հեղինակ Ջեյմի Բարթլեթը քննարկում է առաջադեմ արհեստական բանականության հետ կապված աճող ռիսկերը: Բարթլեթը պնդում է, որ «P…

CNET

OpenAI-ն պաշտոնապես ստեղծել է մաթեմատիկական խորհրդատվական խումբ՝ վերահսկելու առաջադեմ AI տրամաբանության ոլորտում իր հետազոտությունները: Այս քայլը հաջո…

TechCrunch
Advertisement970 × 250