PDF al Teksto — Senpaga, Loka, LLM-Preta
Ĉerpi tekston de unu aŭ multaj PDFs en via retumilo - tri eligstiloj, neniu alŝuto, neniu registriĝo
Drop one or more PDFs onto the page. Every file is parsed locally in your browser and returned as a clean .txt — in your choice of three styles: Standard (Unix-style form-feed between pages), Joined (clean flowing text, best for feeding into ChatGPT / Claude / any LLM), or Numbered (each page prefixed with --- Page N --- for easy reading). 100% in-browser — your PDF never leaves your device.
Forigu viajn PDFs ĉi tie
aŭ
Ne necesas alŝuto. Ĉio funkcias 100% loke en via retumilo.
Kiel Konverti PDF al Teksto Senpage
1. Forigu unu aŭ pli da PDFs
Trenu PDFs sur la falzono supre, aŭ alklaku por foliumi. Ĉiu dosiero estas analizita loke - nenio estas alŝutita al servilo. Plurdosieroj estas subtenataj.
2. Elektu eligan stilon
Norma (defaŭlte, Unikso-stila formo-fluo inter paĝoj), Kunigita (sen paĝrompoj, ideala por enigo de ChatGPT / Claude), aŭ Nombrita (ĉiu paĝo prefiksita per --- Paĝo N ---). Ĉiu karto klarigas ĝuste kion la .txt enhavos.
3. Konverti
Klaku Konverti al Teksto. La tekstotavolo de ĉiu paĝo estas ĉerpita kaj fluita en simplan UTF-8 .txt-dosieron. Eĉ 1000-paĝaj PDFs kutime finiĝas en kelkaj sekundoj.
4. Elŝutu individue
La preta ekrano listigas la .txt de ĉiu PDF kiel sian propran elŝuton. Neniuj ZIPoj, neniuj arkivoj - nur puraj po-dosierbutonoj, sama formo kiel la kunpremfluo.
Kial Uzi Nian Senpagan PDF al Teksto-Konvertilo?
Vere Libera, Por Ĉiam
Neniu provo, neniu kaŝita pagmuro, neniu po-dosiera pagendaĵo, neniu ĉiutaga taskolimo. Ĉerpi tekston el tiom da PDFs kiom vi volas. La servo estas reklam-subtena do ĝi restas senpaga por ĉiuj.
LLM-Preta en Unu Klako
Elektu Kunigitan reĝimon kaj la eligo estas antaŭformata por alglui en ChatGPT, Claude, Gemini aŭ ajnan AI kun teksta enigo. Neniuj formo-fluaj signoj malŝparas ĵetonojn, neniuj neparaj linirompoj konfuzantaj la ĵetonigilon - nur puraj alineoj.
Multi-Dosiero Aro
Faligu 10, 50, 200 PDFs samtempe. Ĉiu fariĝas sia propra .txt dosiero nomita laŭ la fonto. Perfekta por esploraj laborfluoj, plenumaj recenzoj kaj ajna laboro, kiu bezonas tekston el multaj dokumentoj samtempe.
Dosieroj Neniam Forlasu Vian Aparaton
Ĉiu eltiro funkcias loke en via retumilo. Viaj PDFs ne tuŝas niajn servilojn ĉar ni ne havas por viaj dosieroj — ni laŭvorte ne povas vidi viajn dokumentojn.
Neniu Konto, Neniu Retpoŝto
Komencu ĉerpi tuj. Neniu aliĝo, neniu retpoŝta kapto, neniu kreditkarto. La maniero kiel labortabla programaro kutimis funkcii antaŭ "senpagaj provoj".
Neniu Dosiera Grandeco Kap
Tekstraktado estas malmultekosta komputado - ne necesas limigi eniggrandecon. 2GB PDF kun 10,000 paĝoj da tekstaj eltiraĵoj en malpli ol minuto sur tipa tekkomputilo.
Neniu Akvomarko
La .txt enhavas nur kio estis en la PDF. Neniu "konvertite kun..." kaplinio, neniu piedlinio, neniu marko.
Funkcias eksterrete
Post kiam ĉi tiu paĝo estas ŝargita, vi povas malkonekti de la interreto kaj la ekstraktilo ankoraŭ funkcias. Bonega por konfidencaj PDFs, kiujn vi preferus prilabori sen reto.
La Tri Eligo-Stiloj, Klarigitaj
Standard - la Unikso-defaŭlta
Each page's text is followed by a form-feed character (\f, ASCII 12) before the next page begins. This is exactly what the command-line pdftotext utility produces — so anything downstream (Python scripts, awk pipelines, older text editors) treats the output identically. Pick this when you're replacing a pdftotext run.
Aliĝis — por LLM-enigo
Every page break is removed. Pages are separated by a blank line, not a form-feed. The result is one flowing text — ideal for pasting into ChatGPT / Claude / Gemini / any LLM, because those models don't parse \f usefully and each one of those characters costs a token.
Nombrita — por homa legado
Each page is prefixed with --- Page N --- on its own line so you can navigate the .txt in a regular text editor and still see where one page ends and the next begins. Useful for reviewing extracted text manually, or attaching text alongside the original PDF for reference.
Grava: Skanita PDFs Bezonas OCR
If your PDF is a scan — pure images of text with no embedded text layer — this converter will return nothing (or very little). We extract the text that's already in the PDF. Converting images of text to text requires OCR (optical character recognition), which needs a 2MB+ library and deserves its own dedicated tool. We're honest about that limit instead of silently running a weak OCR and returning garbage. To test: open your PDF in any viewer and try selecting text with your mouse. If text highlights, this converter will extract it. If the page highlights as one giant image, you need OCR.
PDF Edit kontraŭ FreeConvert, PDF2Go, Smallpdf, pdftotext.com
| Ilo | PDF Redaktu | FreeConvert | PDF2Go | Smallpdf | pdftotext.com |
|---|---|---|---|---|---|
| Ĉu dosieroj estas altiŝutitaj al servilo? | No — 100% local | Jes | Jes | Jes | Jes |
| Plurdosiera aro? | Unlimited | 1 samtempe | Pagita nur | Pagita nur | 1 samtempe |
| Eligo stiloj? | 3 (Standard / Joined / Numbered) | 1 | 1 | 1 | 1 |
| LLM-preta eligo? | Yes (Joined) | Ne | Ne | Ne | Ne |
| Ĉu konto estas bezonata? | Never | Senpaga nivelo limigita | Senpaga nivelo limigita | Senpaga nivelo limigita | Ne |
| Ĉu estas ĵaŭo-dosier-limito? | None | 5/horo | Grandeco + nombraj ĉapoj | 2/horo | Grandeca ĉapo |
| Ĉu akvomarko estas sur eligo? | No | Ne | Ne | Ne | Ne |
| Ĉu funkcias post-ŝargo sen konekto? | Yes | Ne | Ne | Ne | Ne |
Kiam viaj PDFs enhavas ion ajn, kion vi preferus ne publikigi - skizojn, klientajn raportojn, internajn notojn, esplordatenojn - la diferenco inter nur loka kaj unue alŝuta ne estas oportuna funkcio. Ĝi estas la tuta tonalto.
Kiu Konvertas PDFs al Teksto?
Nutrante PDFs al ChatGPT / Claude
Ĉiu LLM havas tekstan enigon — ne PDF. Konvertu per Kunigita reĝimo kaj algluu la .txt en vian promptilon. Tokens restas efikaj; la modelo legas vian dokumenton sen iu ajn PDF-tubaro en la vojo.
Esploro kaj akademia revizio
Forigu 50 ĵurnalojn PDFs samtempe, konvertu ilin ĉiujn en unu aro, kaj grep / serĉu la tekstkorpon. Multe pli rapide ol Ctrl+F-ing en 50 apartaj PDF spektantoj.
Citado kaj citaĵo
Eltiru specifajn paŝojn el kontraktoj, raportoj aŭ artikoloj por uzi en retpoŝtoj, notoj aŭ artikoloj. Tekstraktado konservas la ĝustan vortumon tiel ke citaĵoj restas precizaj.
Eltiro kaj analizo de datumoj
Financial statements, lab reports, tabular data — get the text out and feed it into spreadsheets, Python scripts, or data pipelines. Standard mode (with form-feed) cooperates nicely with awk / sed / CSV parsers.
Arkivado kaj serĉindeksado
Transformu dokumentarkivon en serĉeblan tekston. Indeksu la .txt dosierojn per ripgrep, Lunr, Meilisearch, aŭ ajna plenteksta serĉilo. PDF-denaska serĉo estas malrapida; teksto serĉo estas tuja.
Alirebleco kaj ekranlegiloj
Puraj .txt-dosieroj estas la plej alirebla formato - ĉiu ekranlegilo parolas ilin denaske, neniuj strangaĵoj de la motoro PDF. Bonega por kunhavigi enhavon kun viddifektitaj legantoj aŭ spektantaroj, kiuj preferas voĉajn interfacojn.
PDF al Teksto sur Ajna Aparato
Nia PDF al teksttransformilo funkcias en ajna aparato kun moderna retumilo — Windows, Mac, Linux, Chromebook, iPad, iPhone, kaj Android. Neniu programaro por instali, neniuj aldonaĵoj necesaj, neniuj administraj rajtoj bezonataj. Post kiam la paĝo ŝargis, vi povas malkonekti de la interreto kaj daŭrigi ĉerpi - ĉio funkcias loke.
Kiel Funkcias Retumilo-Bazita PDF al Teksto-Eltiro?
Your PDF is parsed page by page inside your browser. Every text item is sorted into reading order (top-to-bottom, left-to-right, respecting columns when possible) and serialised as UTF-8 plain text. Page breaks are inserted as form-feed characters (Standard mode), removed entirely (Joined mode), or replaced with --- Page N --- headers (Numbered mode). No server involved at any step — your PDF stays in device memory the whole time.
Oftaj Demandoj
Kiel mi konverti PDF al teksto senpage?
Delasu vian PDF(j) sur la paĝon supre, elektu eligstilon, alklaku Konverti al Teksto. Ĉiu PDF fariĝas sia propra .txt-dosiero elŝutita loke.
Kiu eligostilo estas plej bona por ChatGPT / Claude / LLM-oj?
Aliĝis. Ĝi nudigas paĝrompojn (kiuj malŝparas ĵetonojn) kaj produktas puran fluantan tekston, kiun la modelo povas legi kiel naturaj alineoj.
Ĉu mia PDF estas alŝutita al servilo?
Ne. Eltiro funkcias tute en via retumilo. Via PDF neniam tuŝas niajn servilojn — ni ne havas por viaj dosieroj.
Ĉu mi povas konverti skanitan PDF al teksto?
Ne kun ĉi tiu ilo. Ni ĉerpas la tekstan tavolon enigitan en la PDF. Skanadoj (bildoj de teksto sen teksta tavolo) bezonas OCR, kiu estas aparta biblioteko kaj meritas sian propran ilon. Por testi: provu elekti tekston en via PDF-rigardilo — se teksto reliefigas, ni ĉerpos ĝin; se la paĝo elstaras kiel unu bildo, vi bezonas OCR.
Ĉu mi povas konverti plurajn PDFs samtempe?
Jes. Faligu kiom vi volas. Ĉiu fariĝas sia propra .txt-dosiero sur la preta ekrano — neniuj ZIPoj, neniuj arkivoj, nur individuaj elŝutoj.
Ĉu la teksto konservas aranĝon?
Proksimume jes — legorda, linorompo kaj kolonstrukturon estas konservataj kiam la PDF havas taŭgan tekstotavolon. Kompleksaj enpaĝigoj (dukolumaj revuoj, pezaj tabeloj) foje stranga miksas. Por perfekta enpaĝiga fideleco uzu /pdf-to-word.html anstataŭe.
Ĉu estas dosiera grandeco limo?
Neniu artefarita limo. Tekstraktado estas malmultekosta — eĉ 2GB PDF kun dekoj de miloj da paĝoj kutime finiĝas en malpli ol minuto sur moderna tekkomputilo.
Ĉu la .txt havas akvomarkon aŭ atribuon?
Ne. Nur la teksto de via PDF, nenio aldonita. Neniuj kaplinioj, neniuj piedlinioj, neniu linio "konvertite kun...".
Ĉu mi bezonas konton?
Ne. Neniu aliĝo, neniu retpoŝto, neniu captcha, neniu kreditkarto.
Ĉu ĝi funkcias eksterrete?
Jes, post kiam la paĝo estas ŝargita. Ĉio funkcias en via retumilo — malkonekti kaj daŭre ĉerpi.
Last updated: