Extractor de text de PDF
Extreu el text d'un PDF (pressupost, certificació, contracte) al navegador, sense pujar l'arxiu a cap servidor. Dona el text brut, no reconstrueix taules.
Dona el text brut: no reconstrueix taules. Tampoc funciona amb PDFs escanejats sense capa de text (fotos de documents).
Formats que accepta
Per a qui
Un PDF amb text seleccionable guarda aquesta informació en una capa interna que no sempre és fàcil de copiar entera, sobretot en documents llargs o amb diverses columnes.
Aquest convertidor llegeix aquesta capa de text amb la mateixa llibreria que usa Firefox per mostrar PDFs (pdf.js) i et dona el contingut complet, pàgina a pàgina, al teu propi navegador.
No reconstrueix taules: si el PDF té una taula, el resultat és el text de les cel·les en l'ordre en que apareix a l'arxiu, no columnes separades. Per això cal revisar el resultat a mà.
Com usar-lo sense perdre traçabilitat
El flux recomanat és senzill: conserva l'arxiu original, processa una còpia i comprova la vista prèvia abans de descarregar-la. El convertidor resol una transformació concreta, però no decideix si les dades estan completes, si les unitats són correctes ni si el resultat encaixa amb el sistema on el vas a importar.
Què revisar abans d'utilitzar l'arxiu
Obriu el resultat i reviseu diverses files al principi, al centre i al final. Comproveu noms de fulles, encapçalaments, separadors, caràcters especials i quantitats. En documents tècnics o econòmics, conserva l'original juntament amb la còpia convertida per poder explicar quina versió es va utilitzar i repetir el procés si apareix una diferència.
Parla amb Bloqbase sobre el teu cas