Ինչպես արտահանել տվյալներ PDF-ից Excel. Ամբողջական ուղեցույց
Իմացեք, թե ինչպես արտահանել տվյալներ PDF-ից Excel՝ օգտագործելով Adobe, Power Query, OCR և երրորդ կողմի գործիքներ: Ներառում է անսարքությունների վերացման խորհուրդներ և ճշգրտության ստուգումներ:
A ենթակապալառուն ձեզ ուղարկում է առաջարկը որպես սկանավորված PDF։ Դուք պետք է քանակները, միավոր գները և ընդհանուր գումարները ստանաք Excel-ում մինչև գնահատումը ավարտվի, այնպես որ կատարում եք արտահանում և բացում աշխատանքային գիրքը։ Տողերը առկա են, բայց որոշ վերնագրեր միաձուլված են, որոշ քանակներ սխալ նկարագրությունների հետ են համապատասխանեցված, և մի քանի գումարներ թվերի տեսք ունեն, մինչդեռ Excel-ը դրանք դիտարկում է որպես տեքստ։ Ոչինչ չի հայտարարում, որ տվյալները սխալ են։
Այդպիսին է մարտահրավերը PDF-ից Excel տվյալների արտահանում սովորելու գործում։ Արտահանման կոճակը սովորաբար հեշտ մասն է։ Դժվար աշխատանքը որոշելն է՝ արդյոք PDF-ը պարունակում է օգտագործելի կառուցվածք, ընտրել ճիշտ արդյունահանման մեթոդը և ստուգել աշխատանքային գիրքը մինչև որևէ մեկը օգտագործի այն առաջարկի, բյուջեի, հաշիվ-ապրանքագրի ստուգման կամ շինարարական հաշվարկի համար։
Ինչու են PDF-ից Excel արտահանումները հաճախ ձախողվում առանց ահազանգի
PDF-ը նախագծված է պահպանելու փաստաթղթի տեսքը, ոչ անպայման այն, թե ինչպես է կազմակերպված նրա տեղեկատվությունը։ Տեսանելի աղյուսակը կարող է բաղկացած լինել էջի վրա դիրքավորված տեքստային հատվածներից, այլ ոչ թե տողերից և սյունակներից, որոնք Excel-ը կարող է հասկանալ։ Այդ տարբերությունը բացատրում է, թե ինչու արտահանումը կարող է համոզիչ թվալ, բայց դեռևս արժեքները սխալ դաշտերում տեղավորել։
Ներքին PDF-ը սովորաբար պարունակում է ընտրելի թվային տեքստ։ Սկանավորված PDF-ը հաճախ տպագրված էջի պատկեր է, այնպես որ արդյունահանման գործիքին անհրաժեշտ է օպտիկական նիշերի ճանաչում կամ OCR, նախքան այն կարողանա նույնականացնել բառերն ու թվերը։ Նույնիսկ ներքին ֆայլը կարող է խնդիրներ առաջացնել, երբ պարունակում է բազմաէջ աղյուսակներ, միաձուլված վերնագրեր, անկանոն տարածություն, պտտված էջեր կամ կրկնվող էջային տարրեր։

Մաքուր տեսք ունեցող աշխատանքային գրքում թաքնված սխալները
Կապալառուն կարող է արտահանել արժեքների ժամանակացույց և տեսնել յուրաքանչյուր տողային տարր Excel-ում։ Վտանգավոր սխալները հաճախ կառուցվածքային են, այլ ոչ ակնհայտ։
- Միաձուլված վերնագրեր. Մի քանի սյունակներ ընդգրկող վերնագիրը կարող է հանգեցնել, որ արդյունահանիչը ենթավերնագրերը անհամապատասխան նշանակի։
- Տեղաշարժված սյունակներ. Մեկ տողում բացակայող արժեքը կարող է բոլոր հաջորդ արժեքները տեղափոխել մեկ սյունակ ձախ կամ աջ։
- Տեքստային ձևաչափով թվեր. Թվային տեսք ունեցող գումարները ճիշտ չեն վարվի բանաձևերում, տեսակավորման կամ զտիչներում։
- Կոտրված տողային սահմաններ. Տողերի վրա փաթաթվող նկարագրությունը կարող է դառնալ առանձին տող։
- Կրկնվող էջային բովանդակություն. Վերնագրերն ու ստորագրերը կարող են տեղադրվել տվյալների հավաքածուի մեջտեղում։
- Սխալ ընթերցված նիշեր. OCR-ը կարող է շփոթել թվանշանները, կետադրությունը, խորհրդանիշները և տառերը, հատկապես վատ սկաներներում։
Adobe-ի ուղեցույցը PDF աղյուսակների արդյունահանման սխալների մասին խորհուրդ է տալիս ստուգել աղբյուրը և ստուգել ձևաչափերը փոխակերպումից հետո։ Այդ խորհուրդը կարևոր է, քանի որ աղյուսակը կարող է հաշվարկել առանց զգուշացման, նույնիսկ երբ հիմքում ընկած տողերի քարտեզագրումը սխալ է։
Գործնական կանոն. Երբեք մի հաստատեք արտահանված աշխատանքային գիրքը միայն այն պատճառով, որ այն հաջողությամբ բացվում է։ Հաստատեք այն միայն այն բանից հետո, երբ նրա կառուցվածքը, արժեքները և ընդհանուր գումարները ստուգվել են PDF-ի համեմատ։
Գնահատման թիմերի համար հետևանքը կարող է անմիջական լինել։ Սխալ չափումը, տարրերի քանակը կամ քանակը կարող է անցնել հաշվարկի մեջ և այնուհետև առաջարկի մեջ։ Ֆինանսական թիմերը նույն ռիսկին են բախվում հաշիվ-ապրանքագրերի, հայտարարությունների և հաշվետվությունների հետ։ Վերաբերվեք PDF-ին որպես անվստահելի աղբյուրի, մինչև աղյուսակը անցնի փաստաթղթավորված որակի ստուգում։
Adobe Acrobat-ի և Excel-ի ներկառուցված մեթոդներ
Մաքուր, թվայնորեն ստեղծված PDF-ի համար ներկառուցված գործիքները հաճախ խելամիտ մեկնարկային կետ են։ Adobe Acrobat-ը տրամադրում է ուղղակի արտահանման աշխատանքային հոսք, մինչդեռ Excel-ը կարող է ներմուծել հայտնաբերված աղյուսակները Power Query-ի միջոցով։ Ոչ մի մեթոդ չի վերացնում ստուգման անհրաժեշտությունը, բայց երկուսն էլ կարող են ժամանակ խնայել, երբ աղբյուրի դասավորությունը պարզ է։
Արտահանում Adobe Acrobat-ով
Adobe-ի ընթացիկ աշխատանքային հոսքը պարզ է.
- Բացեք PDF-ը Acrobat-ում։
- Ընտրեք Export PDF։
- Ընտրեք Spreadsheet։
- Ընտրեք Microsoft Excel Workbook (.xlsx)։
- Պահեք ելքային ֆայլը։
- Բացեք աշխատանքային գիրքը և ստուգեք արդյունահանված թերթերը արժեքները խմբագրելուց առաջ։
Acrobat-ը նաև աջակցում է արտահանում XLSX և XML ձևաչափերով՝ կարգավորումներով, որոնք կարող են ստեղծել աշխատաթերթ յուրաքանչյուր աղյուսակի, յուրաքանչյուր էջի կամ ամբողջ փաստաթղթի համար։ Հետևողական աղյուսակներով հաշվետվության համար աշխատաթերթի ընտրությունը ազդում է նրա վրա, թե որքան հեշտ կլինի ստացված աշխատանքային գիրքը զտել և համաձայնեցնել։
Աշխատանքային հոսքը ճանաչելի է մնացել երկար տարիներ։ Adobe-ի ընթացիկ PDF-ից Excel հրահանգները աջակցում են վերոնշյալ արտահանման ուղին, մինչդեռ դրա 2009 թվականի փաստաթղթավորված արտահանման աշխատանքային հոսքը արդեն նկարագրում էր որպես աղյուսակ պահելը, OCR սկանավորված PDF-ների համար և աղյուսակային տվյալների բացումը Excel-ում։ Այդ շարունակականությունը Acrobat-ը դարձնում է գործնական ընտրություն այն օգտատերերի համար, ովքեր կարիք ունեն ծանոթ աշխատասեղանի կամ վեբի վրա հիմնված փոխակերպման ուղու։
Acrobat-ն ամենաօգտակարն է, երբ PDF-ն ունի ընտրելի տեքստ, հետևողական սյունակներ և սահմանափակ դասավորության տատանում։ Այն դառնում է պակաս հուսալի, երբ փաստաթուղթը պատկեր է, ներառում է ձեռագիր նշումներ կամ մի ֆայլում միավորում է մի քանի աղյուսակային ձևավորումներ։

Ներմուծում Excel Power Query-ի միջոցով
Excel-ի ներքին ներմուծման ուղին ձեզ ավելի շատ տեսանելիություն է տալիս այն բանի մասին, թե ինչ է հայտնաբերում հավելվածը.
- Բացեք Excel-ը և ստեղծեք կամ բացեք աշխատանքային գիրք։
- Անցեք Data։
- Ընտրեք Get Data, ապա From File, ապա From PDF։
- Ընտրեք PDF-ը և ընտրեք Import։
- Վերանայեք Navigator վահանակը, որը ցուցադրում է հայտնաբերված աղյուսակները և էջերը։
- Ընտրեք աղյուսակ և ընտրեք Load, կամ ընտրեք Transform Data՝ այն նախ Power Query-ում մաքրելու համար։
Power Query-ն օգտակար է, երբ անհրաժեշտ է հեռացնել կրկնվող վերնագրերը, փոխել տվյալների տեսակները, բաժանել սյունակները, զտել ստորագրերը կամ միավորել աղյուսակները արդյունքը բեռնելուց առաջ։ Այն ձեզ տալիս է կրկնվող փոխակերպման շերտ՝ փոխարեն յուրաքանչյուր բջիջ ձեռքով շտկելու աշխատաթերթում։
Զիջումն այն է, որ Power Query-ն աշխատում է նրանից, ինչ հայտնաբերում է։ Եթե աղբյուրը հուսալի աղյուսակային կառուցվածք չունի, նախադիտումը կարող է անավարտ կամ մասնատված լինել։ Այն նաև ինքնուրույն չի լուծի OCR խնդիրները, այնպես որ սկանավորված փաստաթղթերը դեռևս կարիք ունեն ճանաչման քայլի, նախքան Excel-ը կարողանա աշխատել դրանց բովանդակության հետ։
Օգտագործեք Acrobat մաքուր PDF-ից արագ արտահանման համար։ Օգտագործեք Power Query, երբ անհրաժեշտ է վերահսկվող մաքրում, կրկնվող փոխակերպումներ կամ մի քանի հայտնաբերված աղյուսակների ավելի մտածված մշակում։ Երկու դեպքում էլ պահպանեք սկզբնական PDF-ը և արտահանեք առանձին աշխատանքային ֆայլի։
OCR ճշգրտություն և երբ սկանավորված PDF-ները լրացուցիչ աշխատանքի կարիք ունեն
Սկանավորված PDF-ները պահանջում են այլ մտածելակերպ, քանի որ գործիքը աղյուսակ չի կարդում։ Այն մեկնաբանում է պատկեր և փորձում վերակառուցել տեքստը պիքսելներից։ Սկանի որակը, հակադրությունը, թեքությունը, սեղմումը, ձեռագիրը, կնիքները և ֆոնային աղմուկը բոլորը ազդում են արդյունքի վրա։
Հուսալի աշխատանքային հոսքը սկսվում է աղբյուրի պատրաստումից։ Մեկ տեխնիկական OCR աշխատանքային հոսք PDF արդյունահանման համար խորհուրդ է տալիս աշխատել էջային պատկերներից 300 DPI կամ ավելի բարձր, կատարել OCR, ապա վերլուծել ճանաչված տեքստը աղյուսակային կառուցվածքի մեջ։ Ցածր լուծաչափով պատկերները կտրուկ նվազեցնում են ճանաչման որակը, այնպես որ արտահանման գործիքի բարդության ավելացումը չի կարող փոխհատուցել վատ աղբյուրը։
Օգտագործեք ճշգրտության միջակայքերը որպես որոշման ուղեցույց
Հենանիշային միջակայքերը օգտակար են որոշելու համար, թե որքան ստուգում է արժանի ֆայլը։ Թվային PDF-ները կարող են հասնել մոտավորապես 97% մինչև 99.5% դաշտային ճշգրտության, մինչդեռ ձեռագիր կամ խիստ աղմկոտ փաստաթղթերը կարող են իջնել մոտավորապես 60% մինչև 85%, համաձայն նույն փաստաթղթի տեսակի OCR հենանիշերի։
Այդ թվերը ամեն աշխատանքային հոսքի համար հաստատման շեմեր չեն։ Դրանք ցույց են տալիս, թե ինչու մաքուր, տպագրված ժամանակացույցը կարող է հարմար լինել օժանդակ ավտոմատացման համար, մինչդեռ ձեռագիր դաշտային հաշվետվությունը կամ վնասված ժառանգական սկանը կարիք ունի ինտենսիվ ստուգման։ Քանակի կամ չափման մեջ փոքր նիշային սխալը կարող է ավելի կարևոր լինել, քան շատ ճիշտ ճանաչված բառերը։
2026 թվականի PDF-ից Excel ճշգրտության առանձին համեմատությունը հաղորդում է մոտավորապես 92% մինչև 98% հստակ 300 DPI սկաների համար ուժեղ գործիքներով, մոտավորապես 80% մինչև 93% միջին սկաների համար և մոտավորապես 45% մինչև 80% վատ սկաների համար՝ կախված շարժիչից։ Լայն տարածումը կարևոր գտածոն է։ Փաստաթղթի վիճակը հաճախ կարևոր է նույնքան, որքան ծրագրային ապահովման ընտրությունը։
Նախամշակեք նախքան արդյունահանելը
Նախքան OCR-ը սկսելը, ստուգեք էջերը՝ փոխարեն ամբողջ ֆայլը ուղղակի փոխակերպման ուղարկելու։
- Ստուգեք կողմնորոշումը. Պտտեք հերթափոխվող կամ կողքի էջերը, որպեսզի տեքստը հետևողականորեն ընթանա։
- Բարելավեք ընթեռնելիությունը. Օգտագործեք ավելի հստակ սկան, երբ ստվերները, կնիքները կամ սեղմումը խոչընդոտում են նիշերին։
- Առանձնացրեք փաստաթղթերի տեսակները. Պահեք ժամանակացույցերը, նշումները և օժանդակ էջերը առանձին, երբ դրանք կարիք ունեն տարբեր արդյունահանման կանոնների։
- Հաստատեք լուծաչափը. Նպատակ դրեք 300 DPI հիմնական գիծը, որը նշված է տեխնիկական ուղեցույցում։
- Նույնականացրեք ձեռագիրը. Նշեք ձեռագիր դաշտերը ձեռքով ստուգման համար՝ փոխարեն դրանք դիտարկելու որպես տպագիր տեքստ։
Երբ OCR-ն ավարտվի, համեմատեք ներկայացուցչական տողերը աղբյուրի հետ։ Շինարարական փաստաթղթերի համար նախ ստուգեք քանակները, չափերը, տարրերի նույնացուցիչները և ընդհանուր գումարները։ Ֆինանսական փաստաթղթերի համար ստուգեք ամսաթվերը, տասնորդական տեղադրումը, հաշվի հղումները և գումարները։

Աշխատանքային գիրքը, որը պետք է աջակցի սանտեխնիկական գնահատման ծրագրային ապահովմանը, պետք է վերանայվի նույն խնամքով, ինչ ցանկացած ֆինանսական մուտքագրում։ OCR-ը օգնություն է արդյունահանման համար, ոչ թե ապացույց, որ յուրաքանչյուր բջիջ ճիշտ է։
Երրորդ կողմի գործիքներ և Power Query բարդ աղյուսակների համար
Ներկառուցված փոխարկիչները լավ են աշխատում, երբ աղբյուրը մաքուր է և կանխատեսելի։ Բարդ փաստաթղթերը պահանջում են ավելի մտածված ընտրություն։ Բազմաշարք վերնագրերը, ներդրված աղյուսակները, անկանոն տարածությունը, ջրանշանները, էջի պտույտները և խառը ձեռագիրը կարող են պարտության մատնել պարզ արտահանումը, նույնիսկ երբ էջը մարդու համար ընթեռնելի է թվում։
Power Query-ն հաճախ ամենաուժեղ տարբերակն է, երբ հիմնական աղյուսակներն արդեն հայտնաբերելի են։ Այն կարող է վերնագրերի շարքը բարձրացնել, հեռացնել անցանկալի շարքերը, փոխել տվյալների տիպերը, բաժանել դաշտերը, զտել կրկնվող էջի տարրերը և միավորել ելքերը կրկնվող փոխակերպման միջոցով։ Դա այն արժեքավոր է դարձնում կայուն դասավորությամբ կրկնվող հաշվետվությունների համար։
Նվիրված աղյուսակի արդյունահանման գործիքներն ավելի օգտակար են, երբ անհրաժեշտ է սահմանել աղյուսակի շրջանը, պահպանել կոնկրետ սյունակները կամ արտահանել կառուցվածքային տվյալներ CSV ձևաչափով՝ նախքան Excel-ում բեռնելը։ OCR-կենտրոնացված հարթակներն ավելի հարմար են դառնում, երբ մուտքագրումը սկանավորված է, ծանրաբեռնվածությունը կրկնվող է կամ փաստաթուղթը պարունակում է խառը դասավորություններ, որոնք պահանջում են ճանաչում և դաշտերի քարտեզագրում։
| Մեթոդ | Լավագույնը | Ճշգրտության շրջանակ | Սահմանափակումներ |
|---|---|---|---|
| Adobe Acrobat արտահանում | Մաքուր ներքին PDF-ների և մեկանգամյա աշխատանքային գրքերի համար | Կախված է աղբյուրի որակից և դասավորությունից | Կարող է դժվարանալ բարդ աղյուսակների հետ և պահանջում է վերանայում |
| Excel Power Query | Հայտնաբերված աղյուսակներ, որոնք պահանջում են կրկնվող մաքրում | Կախված է հայտնաբերված կառուցվածքից | Չի փոխարինում OCR-ին և կարող է մասնատել բարդ էջերը |
| Նվիրված աղյուսակի արդյունահանման գործիք | Ընտրված աղյուսակի շրջաններ և կառուցվածքային ներքին PDF-ներ | Կախված է աղբյուրի որակից և արդյունահանման շարժիչից | Կարող է պահանջել ձեռքով աղյուսակի ընտրություն և կարգավորում |
| OCR կամ փաստաթղթերի մշակման գործիք | Սկանավորված ֆայլեր և կրկնվող խառը փաստաթղթերի աշխատանքային հոսքեր | Մոտավորապես 60%-ից 85% ձեռագիր կամ աղմկոտ փաստաթղթերի համար և մինչև մոտ 97%-99.5% թվային PDF-ների համար հաղորդված չափանիշներում, ինչպես փաստագրված է այստեղ | Ճանաչումը դեռևս պահանջում է վավերացում և կարող է պահանջել մարդկային վերանայում |
| CSV-առաջին աշխատանքային հոսք | Պարզ, հարթ տվյալների հավաքածուներ, որոնք պահանջում են հեշտ հետագա բեռնում | Կախված է արդյունահանման որակից | Կորցնում է աշխատանքային գրքի ձևաչափումը և կարող է չպահպանել բարդ հարաբերությունները |
Ընտրեք՝ հիմնվելով փաստաթղթի բարդության վրա
Օգտագործեք CSV, երբ անհրաժեշտ է հարթ տվյալների փոխանակում և աղյուսակը քիչ կառուցվածքային բարդություններ ունի։ Օգտագործեք Power Query, երբ փոխակերպումն ու կրկնելիությունը ավելի կարևոր են, քան տեսողական ձևաչափումը։ Օգտագործեք նվիրված OCR գործիք, երբ փաստաթուղթը սկանավորված է կամ մշակվում է անհամապատասխան ֆայլերի կրկնվող հոսք։
Թույլտվությունների հավաքածուների, ենթակապալառուների նշագրումների և ժառանգական սկաների համար ձեռքով մաքրումը դեռևս կարող է ճիշտ որոշում լինել։ Կարճ, բարձր ռիսկային ֆայլը հաճախ ավելի անվտանգ է անմիջականորեն վերանայել, քան ստիպել անցնել ավտոմատացված խողովակաշարով, որը ստեղծում է հավանական, բայց սխալ հավասարեցված շարքեր։
Երբ շինարարական թիմերը պետք է համեմատեն փաստաթղթերի վերանայման կամ հաշվարկի աշխատանքային հոսքերը, նման կենտրոնացված ռեսուրսը, ինչպես այս Bluebeam համեմատությունը, կարող է օգնել ձևավորել ընտրությունը կատարվող աշխատանքի շուրջ, ոչ միայն արտահանման ձևաչափի։ Ճիշտ գործիքն այն է, որը թողնում է հետագծելի, վերանայելի արդյունք։
Արտահանումից հետո վավերացում և տվյալների մաքրման ստուգաթերթ
Արտահանված աշխատանքային գիրքը աշխատանքային նախագիծ է, մինչև այն անցնի վավերացում։ Սկսեք՝ պահպանելով անձեռնմխելի ելքը, այնուհետև կատարեք ուղղումներ առանձին պատճենում։ Դա ձեզ տալիս է աուդիտի հետք և հնարավորություն է տալիս համեմատել մաքրված տվյալները բնօրինակ էջի հետ։
Ստուգեք կառուցվածքը մինչև արժեքները
Վերանայեք թերթը վերևից ներքև և համեմատեք դասավորությունը PDF-ի հետ։ Փնտրեք կրկնօրինակված վերնագրեր, բացակայող շարքեր, սխալ տեղադրված ստորագրեր, միաձուլված սյունակներ և սյունակների կարգի փոփոխություններ էջերի միջև։ Եթե բազմաէջ աղյուսակը պետք է լիներ շարունակական, հաստատեք, որ երկրորդ էջը սկսվում է ճիշտ դաշտերով, այլ ոչ թե սկսում է նոր, սխալ հավասարեցված աղյուսակ։
Այնուհետև ստուգեք տվյալների տիպերը։ Տեքստի տեսքով արտահանված թվերը հաճախ կրում են բացատներ, արժույթի խորհրդանիշներ, չկոտրվող բացատներ կամ կետադրություն, որոնք խոչընդոտում են հաշվարկներին։ Օգնական սյունակում =VALUE(A2)-ը կարող է փոխարկել մաքուր թվային տողը, մինչդեռ Text to Columns-ը կարող է օգնել առանձնացնել կամ նորմալացնել արժեքները, որոնք ժամանել են որպես տեքստ։ Ստուգեք բջջի ձևաչափը դրանից հետո, քանի որ հաջող թվացող փոխարկումը դեռ կարող է պարունակել թաքնված նիշեր։
Հաշտեցրեք աշխատանքային գիրքը
Օգտագործեք անկախ ստուգումներ՝ մեկ տեսանելի ընդհանուրի վրա հենվելու փոխարեն։
- Համեմատեք շարքերի քանակները։ Հաշվեք ակնկալվող տվյալների շարքերը և բացառեք կրկնվող վերնագրերը կամ ստորագրերի տողերը։
- Վերահաշվարկեք ընդհանուրները։ Օգտագործեք
SUMմաքրված գումարի կամ քանակի սյունակի վրա և համեմատեք արդյունքը PDF-ի ընդհանուրի հետ։ - Ստուգեք դատարկները։ Զտեք հիմնական սյունակները դատարկ բջիջների համար, որտեղ աղբյուրը ցույց է տալիս արժեք։
- Ստուգեք ծայրահեղությունները։ Տեսակավորեք քանակներն ու գումարները՝ բացահայտելու համար սխալ տեղադրված տասնորդականները կամ անսպասելի տեքստը։
- Վերանայեք բանաձևերը։ Հաստատեք, որ բանաձևերը հղում են անում նախատեսված շարքերին և սյունակներին մաքրումից հետո։
PDF արդյունահանման սխալների ուղեցույցը հատկապես մատնանշում է բջջի ձևաչափերը, VALUE-ը, Text to Columns-ը և կառուցվածքը պահպանող արդյունահանումը որպես գործնական պաշտպանիչ միջոցներ։ Այդ ստուգումները արագ են, բայց բռնում են այնպիսի սխալներ, որոնք կարող են գոյատևել պատահական տեսողական վերանայումից։

Վերջապես, փաստաթղթավորեք, թե ինչ է փոխվել։ Եթե ձեր թիմը համատեղում է արտահանված PDF-ները հեռանկարային կամ վաճառողի գրառումների հետ, հետևողական հուսալի առաջատարների արդյունահանման մեթոդները կարող են օգնել պահպանել աղբյուրի տվյալները կազմակերպված՝ նախքան դրանք մուտքագրելը ավելի լայն աղյուսակային աշխատանքային հոսքում։ Սկզբունքը նույնն է՝ պահպանեք աղբյուրը, գրանցեք փոխակերպումները և հստակ դարձրեք վերանայման պատասխանատվությունը։
Ձեր փաստաթղթերի համար ճիշտ աշխատանքային հոսքի ընտրություն
Սկսեք երեք հարցից՝ Արդյո՞ք PDF-ը ներքին է, թե սկանավորված։ Արդյո՞ք աղյուսակը պարզ է, թե բարդ։ Ի՞նչ կլինի Excel-ի տվյալների հետ դրանից հետո։ Մաքուր ներքին աղյուսակը, որն օգտագործվում է թեթև վերլուծության համար, սովորաբար կարող է անցնել Acrobat-ով կամ Excel-ով։ Սկանավորված ժամանակացույցը, որն օգտագործվում է հաշվարկի համար, արժանի է OCR նախապատրաստման և փաստաթղթավորված վերանայման։ Անհամապատասխան ֆայլերի կրկնվող հավաքածուն կարող է արդարացնել նվիրված արդյունահանման աշխատանքային հոսքը մարդկային ստուգմամբ։
Շինարարական թիմերի համար մի վերաբերվեք յուրաքանչյուր PDF էջին որպես տվյալների արդյունահանման խնդրի։ Պլանային գծագրերը կարող են ավելի լավ մշակվել հաշվարկի հարթակի կողմից, որը հասկանում է մասշտաբը, խորհրդանիշները, մակերեսները և գծային չափումները, մինչդեռ արժեքների ժամանակացույցը կարող է համապատասխանել Acrobat-ին կամ Power Query-ին։ Exayard-ը, օրինակ, թույլ է տալիս շինարարական օգտատերերին վերբեռնել PDF կամ պատկերային գծագրեր, ստեղծել հաշվարկ և գնահատում արդյունքներ և արտահանել այդ արդյունքները Excel, PDF կամ CSV։ Տանիքապատման փաստաթղթերի վրա աշխատող թիմերը կարող են նաև վերանայել տանիքապատման գնահատման ծրագրակազմը որպես իրենց աշխատանքային հոսքի գնահատման մաս։
Կառուցեք կրկնվող գործընթաց փաստաթղթի դասի շուրջ։ Գրանցեք աղբյուրի վիճակը, ընտրեք արդյունահանման մեթոդը, պահեք բնօրինակը, վավերացրեք ելքը և նշեք անորոշ էջերը մարդկային վերանայման համար։ Հարցը ոչ թե այն է, թե արդյոք գործիքը կարող է արտահանել ֆայլ, այլ այն, թե արդյոք ձեր թիմը կարող է բացատրել, թե ինչու է ստացված աղյուսակը վստահելի։
Exayard-ը օգնում է շինարարական թիմերին PDF և պատկերային գծագրերը վերածել կառուցվածքային հաշվարկների և գնահատումների, որոնք կարող են արտահանվել Excel, PDF կամ CSV։ Եթե ձեր ընթացիկ գործընթացը ներառում է քանակների պատճենում պլաններից և այնուհետև յուրաքանչյուր տողի ձեռքով ստուգում, այցելեք Exayard՝ գծագրերից առաջարկին պատրաստ տվյալների ավելի կրկնվող ուղին ուսումնասիրելու համար։