Dumiretso sa nilalaman
EditFilipino

Paano gawing searchable ang na-scan na PDF

Litrato ng papel ang na-scan na PDF. Nababasa mo ito, pero hindi ng computer mo: walang nahahanap ang Ctrl+F, hindi ka makakopya ng pangungusap, at walang magagamit ang mga tool na gumagana sa teksto — pag-convert sa Word, pag-summarize, pag-redact gamit ang search. Binabasa ng OCR, o optical character recognition, ang mga salita sa larawan at idinaragdag ang mga ito sa file bilang totoong teksto. Sa device mo ito tumatakbo, at hindi ina-upload ang file.

3 min na basahinInilathala

Mga hakbang

  1. Alamin kung kailangan ito ng PDF mo

    Buksan ang PDF at subukang i-highlight ang isang pangungusap gamit ang mouse, o pindutin ang Ctrl+F at hanapin ang salitang nakikita mo. Kung nahi-highlight at nahahanap ang teksto, may teksto na ang PDF at hindi na kailangan ng OCR. Kung walang nahi-highlight, larawan ang page — iyon ang para sa OCR.

  2. Piliin ang PDF at ang wika nito

    Buksan ang OCR PDF at piliin ang file. Pagkatapos, piliin ang wika ng dokumento: English, Filipino, o pareho para sa mga dokumentong pinaghalo ang dalawa, gaya ng maraming form at sulat dito. Ang pagbasa sa tamang wika ang nagpapatama sa mga salitang gaya ng "pagpapaupa" sa halip na halos-tama lang. Iwanang naka-on ang "Huwag galawin ang mga page na may teksto na" maliban kung may dahilan ka.

  3. Patakbuhin ang OCR at hintaying mabasa ang bawat page

    Pindutin ang Gawing searchable. Sa unang beses, dina-download ng browser mo mula sa site na ito ang recognition engine — mga 9 MB, dagdag 2.5 MB para sa Filipino — at itinatabi ito, kaya agad nang nagsisimula sa susunod. Ilang segundo ang bawat page; matagal-tagal ang mahabang dokumento sa telepono, at ipinapakita ng bar kung gaano na kalayo.

  4. I-download at subukan ang teksto

    Kamukhang-kamukha ng pinili mo ang PDF na mada-download: idinaragdag nang hindi nakikita ang mga salita sa ibabaw ng scan. Hanapin dito gamit ang Ctrl+F ang isang pangalan o numero mula sa page, at kopyahin ang isang talata para makita kung gaano kahusay itong nabasa. Mula rito, puwede na itong idiretso sa PDF sa Word, PDF sa Excel, AI Summarizer o Redact.

Mga madalas itanong

Mag-iiba ba ang itsura ng PDF ko?

Hindi. Hindi ginagalaw ang scan — hindi kino-compress ulit, nililinis o itinutuwid — at nakapatong nang hindi nakikita ang nabasang teksto, nakahanay sa mga salita sa larawan. Kaya rin hindi lumiliit ang file.

Gaano ito katumpak?

Sa malinis at tuwid na scan ng nakalimbag na teksto, halos lahat ng salita ay tama. Humihina ang katumpakan kapag malabo, may anino, nakatagilid o mababa ang resolution ng scan, napakaliit ng letra, o kakaiba ang font. Laging suriin ang mga pangalan, petsa at halaga bago umasa rito — ang 0 na nabasang O ay ang uri ng pagkakamali ng OCR.

Kaya ba nitong basahin ang sulat-kamay?

Hindi maaasahan. Para ito sa nakalimbag na teksto. Minsan nababasa ang maayos na malalaking titik, pero kadalasang mali o hindi nababasa ang sulat-kamay.

Nakapatagilid ang pagka-scan ng page ko. Gagana ba ito?

Kung tuwid ang ipinapakitang page ng PDF, oo — binabasa ang page ayon sa itsura nito. Kung nakapatagilid mismo ang ipinapakitang page, ituwid muna ito gamit ang Rotate PDF bago mag-OCR; hindi nababasa ang tekstong nakapatagilid.

Puwede bang mag-OCR ng litrato sa halip na PDF?

Ilagay muna ang mga litrato sa PDF gamit ang Larawan papuntang PDF, o kunan ang mga page gamit ang Scan to PDF, tapos idaan ang PDF na iyon sa OCR.

Ina-upload ba ang dokumento ko?

Hindi. Sa browser mo binabasa ang mga page, at mula sa site na ito dina-download ang recognition engine, hindi sa iba. Walang anumang tungkol sa dokumento mo ang umaalis sa device mo.

Subukan ang toolGamitin ang OCR PDFGawing searchable ang na-scan na PDF, na may tekstong napipili at nakokopya.

Ibahagi ang gabay na ito