PDF 转文本
把 PDF 中的所有文字提取成纯文本 .txt 文件,可以搜索、编辑,或交给其他工具处理。全程在浏览器中完成,文件不会上传。
或将文件拖到这里
最大 50 MB- 1选择
选择一个包含可选中文字的 PDF。
- 2调整
可以限定页面范围,并选择是否标记分页位置。
- 3下载
点击“提取文本”,下载 .txt 文件。
要所有文字,不要任何格式
ShyPDF 读取 PDF 的文字层,写出一个纯文本 .txt 文件:换行保留,分页可选标记,其他一律去除。把文档交给脚本、翻译工具或 AI 模型,统计字数,或者粘贴到和 PDF 格式八字不合的地方——这正是你想要的形态。
用 1-3, 5 这样的范围可以只提取指定页面。分页标记让每一行都能追溯到它来自哪一页。
如果输出是空的
扫描版 PDF 没有文字层——它是文字的照片——所以无从提取。请改用“OCR 识别”:它从页面图像中识别文字,还能直接输出纯文本。而当你需要的不是原始文字而是结构——段落、标题、表格——“PDF 转 Word”可以重建一份可编辑的文档。
提取在浏览器中进行。合同、病历,以及任何你不愿粘贴到陌生网站的内容,文件都不会离开你的设备。
常见问题
我的文件会上传到服务器吗?
不会。所有处理都在你的浏览器中完成,文件不会离开你的设备。关掉标签页,什么都不会留下。
输出是空的或者乱码,为什么?
如果是空的,你的 PDF 很可能是扫描件——请用“OCR 识别”处理,它可以直接输出纯文本。乱码通常意味着 PDF 使用了特殊的字体编码;“OCR 识别”从页面图像读取文字,往往也能救回这类文件。
会保留排版吗?
换行会保留,页面之间也有分隔,但分栏、表格和格式都不会保留——纯文本本来就没有这些。需要保留结构的话,请用“PDF 转 Word”。