PDF සිට පෙළට — නොමිලේ, දේශීය, LLM-සූදානම්
ඔබගේ බ්රවුසරයේ PDF එකකින් හෝ බොහෝ ගණනකින් පෙළ උපුටා ගන්න - ප්රතිදාන මෝස්තර තුනක්, උඩුගත කිරීමක් නැත, ලියාපදිංචියක් නැත
Drop one or more PDFs onto the page. Every file is parsed locally in your browser and returned as a clean .txt — in your choice of three styles: Standard (Unix-style form-feed between pages), Joined (clean flowing text, best for feeding into ChatGPT / Claude / any LLM), or Numbered (each page prefixed with --- Page N --- for easy reading). 100% in-browser — your PDF never leaves your device.
ඔබේ PDFs මෙහි දමන්න
නොහොත්
උඩුගත කිරීම අවශ්ය නොවේ. ඔබගේ බ්රවුසරයේ සෑම දෙයක්ම 100% දේශීයව ක්රියාත්මක වේ.
PDF එකක් නොමිලේ Text බවට පරිවර්තනය කරන්නේ කෙසේද?
1. PDFs එකක් හෝ කිහිපයක් දමන්න
PDFs ඉහත පතන කලාපයට අදින්න, නැතහොත් බ්රවුස් කිරීමට ක්ලික් කරන්න. සෑම ගොනුවක්ම දේශීයව විශ්ලේෂණය කරනු ලැබේ - සේවාදායකයකට කිසිවක් උඩුගත නොකෙරේ. බහු ගොනු කාණ්ඩ සඳහා සහය දක්වයි.
2. නිමැවුම් විලාසයක් තෝරන්න
සම්මත (පෙරනිමි, පිටු අතර Unix ආකාරයේ පෝරමය-සංග්රහය), සම්බන්ධ වූ (පිටු බිඳීම් නොමැත, ChatGPT / Claude ආදානය සඳහා වඩාත් සුදුසුය) හෝ අංකිත (එක් එක් පිටුව --- පිටුව N --- සමඟ උපසර්ග කර ඇත). සෑම කාඩ්පතක්ම .txt හි අඩංගු වන්නේ කුමක්ද යන්න හරියටම පැහැදිලි කරයි.
3. පරිවර්තනය කරන්න
Convert to Text ක්ලික් කරන්න. සෑම පිටුවකම පෙළ ස්ථරයක් උපුටා ගෙන සරල UTF-8 .txt ගොනුවකට ප්රවාහය කෙරේ. පිටු 1000 PDFs පවා සාමාන්යයෙන් තත්පර කිහිපයකින් අවසන් වේ.
4. තනි තනිව බාගත කරන්න
සූදානම් තිරය එක් එක් PDF හි .txt එහි ම බාගත කිරීමක් ලෙස ලැයිස්තුගත කරයි. ZIP නැත, ලේඛනාගාර නැත - එක් ගොනුවකට බොත්තම් පිරිසිදු කරන්න, සම්පීඩන ප්රවාහයට සමාන හැඩය.
අපගේ නොමිලේ PDF සිට පෙළ පරිවර්තකය භාවිතා කරන්නේ ඇයි?
සැබවින්ම නොමිලේ, සදහටම
අත්හදා බැලීමක් නැත, සැඟවුණු ගෙවීම් පවුරක් නැත, ගොනුවකට ගාස්තුවක් නැත, දෛනික කාර්ය සීමාවක් නැත. ඔබට අවශ්ය තරම් PDFs ගණනකින් පෙළ උපුටා ගන්න. සේවාව වෙළඳ දැන්වීම් සඳහා සහය දක්වන බැවින් එය සැමට නොමිලයේ පවතී.
LLM-එක් ක්ලික් එකකින් සූදානම්
Joined මාදිලිය තෝරන්න සහ ප්රතිදානය ChatGPT, Claude, Gemini, හෝ පෙළ ආදානයක් සහිත ඕනෑම AI වෙත ඇලවීම සඳහා පෙර-ෆෝමැට් කර ඇත. ටෝකන නාස්ති කරන පෝරම-පෝෂක අක්ෂර නැත, ටෝකනයිසර් ව්යාකූල කරන අමුතු රේඛා බිඳීම් නැත - පිරිසිදු ඡේද පමණි.
බහු ගොනු කණ්ඩායම
10, 50, 200 PDFs එකවර පහත දමන්න. සෑම එකක්ම ප්රභවයෙන් නම් කර ඇති තමන්ගේම .txt ගොනුවක් බවට පත්වේ. පර්යේෂණ කාර්ය ප්රවාහ, අනුකූලතා සමාලෝචන සහ එකවර ලේඛන ගණනාවකින් පෙළ අවශ්ය ඕනෑම රැකියාවක් සඳහා පරිපූර්ණයි.
ගොනු කිසි විටෙකත් ඔබේ උපාංගයෙන් ඉවත් නොවේ
සියලුම නිස්සාරණය ඔබගේ බ්රවුසරයේ දේශීයව ක්රියාත්මක වේ. ඔබගේ PDFs අපගේ සේවාදායකයන් ස්පර්ශ නොකරන්නේ ඔබගේ ගොනු සඳහා කිසිවක් අප සතුව නොමැති නිසා — අපට ඔබගේ ලේඛන වචනානුසාරයෙන් දැකිය නොහැක.
ගිණුමක් නැත, විද්යුත් තැපෑලක් නැත
වහාම උපුටා ගැනීම ආරම්භ කරන්න. ලියාපදිංචිය නැත, ඊමේල් ග්රහණයක් නැත, ක්රෙඩිට් කාඩ්පතක් නැත. ඩෙස්ක්ටොප් මෘදුකාංගය "නොමිලේ අත්හදා බැලීම්" වලට පෙර ක්රියා කළ ආකාරය.
File Size Cap නැත
පෙළ නිස්සාරණය ලාභ ගණනය කිරීමකි - ආදාන ප්රමාණය සීමා කිරීම අවශ්ය නොවේ. සාමාන්ය ලැප්ටොප් එකකින් විනාඩියකට අඩු කාලයකදී පිටු 10,000ක පාඨ උපුටා ගැනීමක් සහිත 2GB PDF.
දිය සලකුණක් නැත
.txt හි අඩංගු වන්නේ PDF හි තිබූ දේ පමණි. "පරිවර්තනය වූ..." ශීර්ෂයක් නැත, පාදක සබැඳියක් නැත, වෙළඳ නාමකරණයක් නැත.
නොබැඳි ලෙස ක්රියා කරයි
මෙම පිටුව පූරණය වූ පසු ඔබට අන්තර්ජාලයෙන් විසන්ධි විය හැකි අතර නිස්සාරකය තවමත් ක්රියා කරයි. රහස්ය PDFs සඳහා විශිෂ්ටයි, ඔබ ජාලයක් නොමැතිව ක්රියා කරයි.
ප්රතිදාන මෝස්තර තුන, පැහැදිලි කර ඇත
සම්මත - Unix පෙරනිමිය
Each page's text is followed by a form-feed character (\f, ASCII 12) before the next page begins. This is exactly what the command-line pdftotext utility produces — so anything downstream (Python scripts, awk pipelines, older text editors) treats the output identically. Pick this when you're replacing a pdftotext run.
සම්බන්ධ විය - LLM ආදානය සඳහා
Every page break is removed. Pages are separated by a blank line, not a form-feed. The result is one flowing text — ideal for pasting into ChatGPT / Claude / Gemini / any LLM, because those models don't parse \f usefully and each one of those characters costs a token.
අංකිත - මිනිස් කියවීම සඳහා
Each page is prefixed with --- Page N --- on its own line so you can navigate the .txt in a regular text editor and still see where one page ends and the next begins. Useful for reviewing extracted text manually, or attaching text alongside the original PDF for reference.
වැදගත්: ස්කෑන් කළ PDFs සඳහා OCR අවශ්යයි
If your PDF is a scan — pure images of text with no embedded text layer — this converter will return nothing (or very little). We extract the text that's already in the PDF. Converting images of text to text requires OCR (optical character recognition), which needs a 2MB+ library and deserves its own dedicated tool. We're honest about that limit instead of silently running a weak OCR and returning garbage. To test: open your PDF in any viewer and try selecting text with your mouse. If text highlights, this converter will extract it. If the page highlights as one giant image, you need OCR.
PDF Edit එදිරිව FreeConvert, PDF2Go, Smallpdf, pdftotext.com
| විශේෂාංගය | PDF Edit | FreeConvert | PDF2Go | Smallpdf | pdftotext.com |
|---|---|---|---|---|---|
| ගොනු සේවාදායකයකට උඩුගත කරයිද? | No — 100% local | ඔව් | ඔව් | ඔව් | ඔව් |
| බහු ගොනු කණ්ඩායම? | Unlimited | 1 වරකට | ගෙවා පමණි | ගෙවා පමණි | 1 වරකට |
| නිමැවුම් මෝස්තර? | 3 (Standard / Joined / Numbered) | 1 | 1 | 1 | 1 |
| LLM-සුදානම් ප්රතිදානයද? | Yes (Joined) | නැත | නැත | නැත | නැත |
| ගිණුමක් අවශ්යද? | Never | නිදහස් ස්ථර සීමා සහිතයි | නිදහස් ස්ථර සීමා සහිතයි | නිදහස් ස්ථර සීමා සහිතයි | නැත |
| දෛනික ගොනු සීමාවක්ද? | None | 5 / පැය | ප්රමාණය + ගණන් කැප් | 2 / පැය | ප්රමාණයේ තොප්පිය |
| ප්රතිදානයේ ජල සලකුණද? | No | නැත | නැත | නැත | නැත |
| පූරණය කිරීමෙන් පසු නොබැඳිව ක්රියා කරයිද? | Yes | නැත | නැත | නැත | නැත |
ඔබේ PDFs හි ඔබ ප්රකාශනය නොකරන ඕනෑම දෙයක් අඩංගු වන විට - කෙටුම්පත්, සේවාදායක සංක්ෂිප්ත, අභ්යන්තර මතක සටහන්, පර්යේෂණ දත්ත - දේශීය පමණක් සහ උඩුගත කිරීම-පළමුව අතර වෙනස පහසු ලක්ෂණයක් නොවේ. එය මුළු තණතීරුවයි.
PDFs පෙළ බවට පරිවර්තනය කරන්නේ කවුද?
ChatGPT / Claude වෙත PDFs පෝෂණය කිරීම
සෑම LLM එකකම පෙළ ආදානයක් ඇත — PDF ආදානයක් නොවේ. Joined මාදිලිය සමඟ පරිවර්තනය කර .txt ඔබේ විමසුමට අලවන්න. ටෝකන කාර්යක්ෂමව පවතී; ආකෘතිය කිසිදු PDF ජලනල පද්ධතියකින් තොරව ඔබේ ලේඛනය කියවයි.
පර්යේෂණ සහ ශාස්ත්රීය සමාලෝචනය
සඟරා 50ක් PDFs එකවර දමන්න, ඒවා සියල්ලම එක කණ්ඩායමකට පරිවර්තනය කරන්න, සහ පෙළ සංග්රහය grep / සොයන්න. වෙනම PDF නරඹන්නන් 50ක් ඇතුළත Ctrl+F-ing වලට වඩා ඉතා වේගවත්.
උපුටා ගැනීම සහ උපුටා ගැනීම
ඊමේල්, මතක සටහන් හෝ ලිපිවල භාවිතය සඳහා කොන්ත්රාත්තු, වාර්තා හෝ පත්රිකාවලින් නිශ්චිත ඡේද ඉවත් කරන්න. පෙළ උපුටා ගැනීම නිවැරදි වචන ආරක්ෂා කරයි, එබැවින් උපුටා දැක්වීම් නිවැරදි වේ.
දත්ත උපුටා ගැනීම සහ විශ්ලේෂණය
Financial statements, lab reports, tabular data — get the text out and feed it into spreadsheets, Python scripts, or data pipelines. Standard mode (with form-feed) cooperates nicely with awk / sed / CSV parsers.
සංරක්ෂිත කිරීම සහ සුචිගත කිරීම සෙවීම
ලේඛන සංරක්ෂිතයක් සෙවිය හැකි පෙළ බවට පත් කරන්න. ripgrep, Lunr, Meilisearch, හෝ ඕනෑම සම්පූර්ණ පෙළ සෙවුම් යන්ත්රයක් සමඟින් .txt ගොනු සුචිගත කරන්න. PDF-දේශීය සෙවුම මන්දගාමී වේ; පෙළ සෙවීම ක්ෂණික වේ.
ප්රවේශ්යතාව සහ තිර කියවනය
Clean .txt ගොනු වඩාත්ම ප්රවේශ විය හැකි ආකෘතියයි - සෑම තිර කියවනයක්ම ඒවා ස්වදේශීයව කථා කරයි, PDF එන්ජිමේ විචක්ෂණ නොමැත. දෘශ්යාබාධිත පාඨකයන් හෝ කටහඬ අතුරුමුහුණත්වලට කැමති ප්රේක්ෂකයින් සමඟ අන්තර්ගතය බෙදා ගැනීමට විශිෂ්ටයි.
ඕනෑම උපාංගයක පෙළ යැවීමට PDF
අපගේ PDF සිට පෙළ පරිවර්තකය නවීන බ්රවුසරයක් සහිත ඕනෑම උපාංගයක් මත ක්රියා කරයි — Windows, Mac, Linux, Chromebook, iPad, iPhone, සහ Android. ස්ථාපනය කිරීමට මෘදුකාංග නැත, ප්ලගීන අවශ්ය නැත, පරිපාලක අයිතිවාසිකම් අවශ්ය නොවේ. පිටුව පූරණය වූ පසු, ඔබට අන්තර්ජාලයෙන් විසන්ධි කර උපුටා ගැනීම දිගටම කරගෙන යා හැක - සියල්ල දේශීයව ක්රියාත්මක වේ.
බ්රව්සරය පදනම් කරගත් PDF සිට පෙළ උපුටා ගැනීම ක්රියා කරන්නේ කෙසේද?
Your PDF is parsed page by page inside your browser. Every text item is sorted into reading order (top-to-bottom, left-to-right, respecting columns when possible) and serialised as UTF-8 plain text. Page breaks are inserted as form-feed characters (Standard mode), removed entirely (Joined mode), or replaced with --- Page N --- headers (Numbered mode). No server involved at any step — your PDF stays in device memory the whole time.
නිතර අසන ප්රශ්න
PDF එකක් නොමිලේ අකුරු බවට පරිවර්තනය කරන්නේ කෙසේද?
ඉහත පිටුවේ ඔබේ PDF(s) දමන්න, ප්රතිදාන විලාසයක් තෝරන්න, පෙළට පරිවර්තනය කරන්න ක්ලික් කරන්න. සෑම PDF එකක්ම දේශීයව බාගත කළ තමන්ගේම .txt ගොනුවක් බවට පත්වේ.
ChatGPT / Claude / LLMs සඳහා හොඳම නිමැවුම් විලාසය කුමක්ද?
එකතු වුණා. එය පිටු බිඳීම් (අපද්රව්ය ටෝකන) ඉවත් කරන අතර ආකෘතියට ස්වාභාවික ඡේද ලෙස කියවිය හැකි පිරිසිදු ගලා යන පෙළ නිපදවයි.
මගේ PDF සේවාදායකයකට උඩුගත කර තිබේද?
නැත. උපුටා ගැනීම සම්පූර්ණයෙන්ම ඔබගේ බ්රවුසරයේ ක්රියාත්මක වේ. ඔබගේ PDF කිසිවිටෙක අපගේ සේවාදායකයන් ස්පර්ශ නොකරයි - ඔබගේ ගොනු සඳහා කිසිවක් අප සතුව නොමැත.
මට ස්කෑන් කළ PDF එකක් පෙළ බවට පරිවර්තනය කළ හැකිද?
මෙම මෙවලම සමඟ නොවේ. අපි PDF හි තැන්පත් කර ඇති පෙළ ස්ථරය උපුටා ගනිමු. ස්කෑන් (පෙළ ස්ථරයක් නොමැති පෙළෙහි පින්තූර) සඳහා OCR අවශ්ය වේ, එය වෙනම පුස්තකාලයක් වන අතර එහිම මෙවලමක් ලැබිය යුතුය. පරීක්ෂා කිරීමට: ඔබේ PDF දසුන් තුළ පෙළ තේරීමට උත්සාහ කරන්න — පෙළ උද්දීපනය කරන්නේ නම්, අපි එය උපුටා ගන්නෙමු; පිටුව එක් රූපයක් ලෙස උද්දීපනය කරන්නේ නම්, ඔබට OCR අවශ්ය වේ.
මට එකවර PDF කිහිපයක් පරිවර්තනය කළ හැකිද?
ඔව්. ඔබට අවශ්ය තරම් ප්රමාණයක් දමන්න. සෑම එකක්ම සූදානම් තිරය මත තමන්ගේම .txt ගොනුවක් බවට පත්වේ - ZIP නැත, සංරක්ෂිත නැත, තනි තනි බාගැනීම් පමණි.
පෙළ පිරිසැලසුම ආරක්ෂා කරයිද?
ආසන්නව ඔව් — PDF හිදී proper text layer ඇත්නම් reading order, line breaks, සහ column structure ආරක්ෂා කෙරේ. Complex layouts (two-column magazines, heavy tables) සමහර විට oddly interleave වේ. Perfect layout fidelity සඳහා /pdf-to-word.html භාවිත කරන්න.
ගොනු ප්රමාණයේ සීමාවක් තිබේද?
කෘතිම සීමාවක් නොමැත. පෙළ උපුටා ගැනීම ලාභදායී වේ - පිටු දස දහස් ගණනක් සහිත 2GB PDF පවා සාමාන්යයෙන් නවීන ලැප්ටොප් එකකින් විනාඩියකට අඩු කාලයකින් අවසන් වේ.
.txt හි දිය සලකුණක් හෝ ආරෝපණයක් තිබේද?
නැත. ඔබේ PDF වෙතින් පෙළ පමණක්, කිසිවක් එකතු කර නැත. ශීර්ෂක නැත, පාදක සබැඳි නැත, "පරිවර්තනය වූ..." රේඛාවක් නැත.
මට ගිණුමක් අවශ්යද?
නැත. ලියාපදිංචිය නැත, ඊමේල් නැත, කැප්චා නැත, ක්රෙඩිට් කාඩ් නැත.
එය නොබැඳි ලෙස ක්රියා කරයිද?
ඔව්, පිටුව පූරණය වූ පසු. ඔබගේ බ්රවුසරයේ සෑම දෙයක්ම ක්රියාත්මක වේ - විසන්ධි කර උපුටා ගැනීම දිගටම කරගෙන යන්න.
Last updated: