PDF a texto: gratuíto, local, listo para LLM

Extrae texto dun ou varios PDFs no teu navegador: tres estilos de saída, sen carga, sen rexistro

Drop one or more PDFs onto the page. Every file is parsed locally in your browser and returned as a clean .txt — in your choice of three styles: Standard (Unix-style form-feed between pages), Joined (clean flowing text, best for feeding into ChatGPT / Claude / any LLM), or Numbered (each page prefixed with --- Page N --- for easy reading). 100% in-browser — your PDF never leaves your device.

100% gratuíto para sempre Sen conta 100% no seu dispositivo Cifrado de grado militar
Os ficheiros nunca saín do seu dispositivo
Cifrado AES-256
Non podemos ver os seus documentos
Non se require conexión

Deixa o teu PDFs aquí

ou

Non é necesario cargar. Todo funciona 100% localmente no teu navegador.

Como converter un PDF a texto de balde

1. Solta un ou máis PDFs

Arrastra PDFs ata a zona de soltar de arriba ou fai clic para navegar. Cada ficheiro analízase localmente; non se carga nada a un servidor. Admítense lotes de varios ficheiros.

2. Escolla un estilo de saída

Estándar (predeterminado, feed de formularios de estilo Unix entre páxinas), unidos (sen saltos de páxina, ideal para a entrada de ChatGPT/Claude) ou numerados (cada páxina ten como prefixo --- Páxina N ---). Cada tarxeta explica exactamente o que conterá o .txt.

3. Converter

Fai clic en Converter a texto. A capa de texto de cada páxina extráese e transmítese nun ficheiro .txt UTF-8 simple. Incluso os PDF de 1000 páxinas adoitan rematar en poucos segundos.

4. Descarga individualmente

A pantalla de lista lista os .txt de cada PDF como a súa propia descarga. Sen ZIP, sen arquivos: só limpar botóns por ficheiro, a mesma forma que o fluxo de compresión.

Por que usar o noso conversor gratuíto de PDF a texto?

Verdadeiramente gratis, para sempre

Sen proba, sen muro de pago oculto, sen cargo por ficheiro, sen límite de tarefas diarias. Extrae texto de tantos PDFs como queiras. O servizo é compatible con anuncios, polo que permanece gratuíto para todos.

LLM-Ready nun clic

Escolla o modo unido e a saída está formateada previamente para pegar en ChatGPT, Claude, Gemini ou calquera AI cunha entrada de texto. Non hai personaxes de feed de formularios que desperdicien fichas, sen saltos de liña estraños que confundan o tokenizer: só limpa parágrafos.

Lote de varios ficheiros

Solta 10, 50, 200 PDFs á vez. Cada un convértese no seu propio ficheiro .txt co nome da fonte. Perfecto para fluxos de traballo de investigación, revisións de conformidade e calquera traballo que necesite texto de moitos documentos á vez.

Os ficheiros nunca saen do teu dispositivo

Toda a extracción execútase localmente no teu navegador. Os teus PDFs non tocan os nosos servidores porque non temos ningún para os teus ficheiros; literalmente non podemos ver os teus documentos.

Sen conta, sen correo electrónico

Comeza a extraer inmediatamente. Sen rexistro, sen captura de correo electrónico, sen tarxeta de crédito. Como funcionaba o software de escritorio antes das "probas gratuítas".

Sen límite de tamaño de ficheiro

A extracción de texto é unha computación barata; non é necesario limitar o tamaño da entrada. Un PDF de 2 GB con 10.000 páxinas de extractos de texto en menos dun minuto nun portátil típico.

Sen marca de auga

O .txt só contén o que estaba no PDF. Sen cabeceira "convertido con...", sen ligazón ao pé de páxina, sen marca.

Funciona fóra de liña

Unha vez cargada esta páxina podes desconectarte de Internet e o extractor aínda funciona. Ideal para PDFs confidenciais que prefieres procesar sen unha rede.

Os tres estilos de saída, explicados

Estándar: o valor predeterminado de Unix

Each page's text is followed by a form-feed character (\f, ASCII 12) before the next page begins. This is exactly what the command-line pdftotext utility produces — so anything downstream (Python scripts, awk pipelines, older text editors) treats the output identically. Pick this when you're replacing a pdftotext run.

Uniuse: para a entrada de LLM

Every page break is removed. Pages are separated by a blank line, not a form-feed. The result is one flowing text — ideal for pasting into ChatGPT / Claude / Gemini / any LLM, because those models don't parse \f usefully and each one of those characters costs a token.

Numerado - para lectura humana

Each page is prefixed with --- Page N --- on its own line so you can navigate the .txt in a regular text editor and still see where one page ends and the next begins. Useful for reviewing extracted text manually, or attaching text alongside the original PDF for reference.

Importante: PDFs dixitalizados Necesitas OCR

If your PDF is a scan — pure images of text with no embedded text layer — this converter will return nothing (or very little). We extract the text that's already in the PDF. Converting images of text to text requires OCR (optical character recognition), which needs a 2MB+ library and deserves its own dedicated tool. We're honest about that limit instead of silently running a weak OCR and returning garbage. To test: open your PDF in any viewer and try selecting text with your mouse. If text highlights, this converter will extract it. If the page highlights as one giant image, you need OCR.

PDF Edit vs FreeConvert, PDF2Go, Smallpdf, pdftotext.com

Función PDF Edit FreeConvert PDF2Go Smallpdf pdftotext.com
Ficheiros subidos a un servidor? No — 100% local SiSiSiSi
Lote de varios ficheiros? Unlimited 1 á vezSó de pagoSó de pago1 á vez
Estilos de saída? 3 (Standard / Joined / Numbered) 1111
Saída lista para LLM? Yes (Joined) NonNonNonNon
Require conta? Never Nivel gratuíto limitado Nivel gratuíto limitado Nivel gratuíto limitado Non
Límite diario de ficheiros? None 5/hora Tamaño + tapas de conta 2/hora Tapa de tamaño
Marca de auga na saída? No NonNonNonNon
Funciona sen conexión tras cargar? Yes NonNonNonNon

Cando os teus PDFs conteñen algo que prefires non publicar (borradores, informes de clientes, notas internas, datos de investigación), a diferenza entre só local e cargar primeiro non é unha función de conveniencia. É todo o campo.

Quen converte PDFs en texto?

Alimentando PDFs a ChatGPT / Claude

Cada LLM ten unha entrada de texto, non unha entrada PDF. Converte co modo unido e pega o .txt no teu aviso. Os tokens seguen sendo eficaces; o modelo le o teu documento sen ningún PDF encanamento no camiño.

Investigación e revisión académica

Solta 50 PDFs de diarios á vez, convérteos todos nun lote e busca grep / no corpus de texto. Moito máis rápido que Ctrl+F-ing dentro de 50 visores PDF separados.

Cita e cita

Extrae pasajes específicos de contratos, informes ou documentos para utilizalos en correos electrónicos, notas ou artigos. A extracción de texto conserva a redacción exacta para que as citas sexan precisas.

Extracción e análise de datos

Financial statements, lab reports, tabular data — get the text out and feed it into spreadsheets, Python scripts, or data pipelines. Standard mode (with form-feed) cooperates nicely with awk / sed / CSV parsers.

Arquivo e indexación de buscas

Converte un arquivo de documentos en texto que se pode buscar. Indexa os ficheiros .txt con ripgrep, Lunr, Meilisearch ou calquera buscador de texto completo. PDF-busca nativa é lenta; a busca de texto é instantánea.

Accesibilidade e lectores de pantalla

Os ficheiros .txt limpos son o formato máis accesible: todos os lectores de pantalla fálanos de xeito nativo, sen peculiaridades do motor PDF. Ideal para compartir contido con lectores con discapacidade visual ou audiencias que prefiren interfaces de voz.

PDF para enviar texto en calquera dispositivo

O noso conversor de texto PDF funciona en calquera dispositivo cun navegador moderno: Windows, Mac, Linux, Chromebook, iPad, iPhone e Android. Non hai software para instalar, non se necesitan complementos, nin se necesitan dereitos de administrador. Unha vez cargada a páxina, podes desconectarte de Internet e continuar a extracción: todo funciona localmente.

Como funciona a extracción de texto baseada no navegador PDF?

Your PDF is parsed page by page inside your browser. Every text item is sorted into reading order (top-to-bottom, left-to-right, respecting columns when possible) and serialised as UTF-8 plain text. Page breaks are inserted as form-feed characters (Standard mode), removed entirely (Joined mode), or replaced with --- Page N --- headers (Numbered mode). No server involved at any step — your PDF stays in device memory the whole time.

Preguntas frecuentes

Como converto un PDF en texto de balde?

Deixa o teu PDF(s) na páxina anterior, escolle un estilo de saída e fai clic en Converter en texto. Cada PDF convértese no seu propio ficheiro .txt descargado localmente.

Que estilo de saída é mellor para ChatGPT/Claude/LLM?

Uniuse. Elimina os saltos de páxina (que desperdician fichas) e produce un texto fluído limpo que o modelo pode ler como parágrafos naturais.

O meu PDF está cargado nun servidor?

Non. A extracción execútase enteiramente no teu navegador. O teu PDF nunca toca os nosos servidores; non temos ningún para os teus ficheiros.

Podo converter un PDF dixitalizado en texto?

Non con esta ferramenta. Extraemos a capa de texto incrustada no PDF. Os escaneos (imaxes de texto sen capa de texto) necesitan OCR, que é unha biblioteca separada e merece a súa propia ferramenta. Para probar: proba a seleccionar texto no teu visor PDF — se o texto resalta, extraémolo; se a páxina destaca como unha soa imaxe, necesitas OCR.

Podo converter varios PDFs á vez?

Si. Bota cantos queiras. Cada un convértese no seu propio ficheiro .txt na pantalla lista: sen ZIP, sen arquivos, só descargas individuais.

O texto conserva o deseño?

Aproximadamente si — a orde de lectura, os saltos de liña e a estrutura de columnas consérvanse cando o PDF ten unha capa de texto adecuada. Os deseños complexos (revistas de dúas columnas, táboas pesadas) ás veces entrelazan de forma estraña. Para a fidelidade perfecta do deseño usa /pdf-to-word.html.

Hai un límite de tamaño de ficheiro?

Sen límite artificial. A extracción de texto é barata: incluso un PDF de 2 GB con decenas de miles de páxinas adoita rematar en menos dun minuto nun portátil moderno.

O .txt ten marca de auga ou atribución?

Non. Só o texto do teu PDF, nada engadido. Sen cabeceiras, sen ligazóns ao pé de páxina, sen liña "convertido con...".

Necesito unha conta?

Non. Sen rexistro, sen correo electrónico, sen captcha, sen tarxeta de crédito.

Funciona sen conexión?

Si, unha vez cargada a páxina. Todo funciona no teu navegador: desconéctate e continúa extraendo.

Last updated:

About this tool: PDF Edit is built by a small independent team who were tired of online tools uploading user files to servers they didn't control. Everything here runs in your browser — your PDF stays on your device, there's no size limit, no signup, and no watermark on the text output. Three output styles (Standard / Joined / Numbered) give you the format you actually need. Free forever, ad-supported. Reach out via the footer links with bugs or feature requests.