首页/全部工具/PDF 提取文字
PDF文字层 · 指定页码 · UTF-8 TXT

PDF 里的文字,
直接复制或下载。

从文字型PDF的全部或指定页面提取可复制文字,可加入页码分隔并下载TXT。文档只在当前浏览器处理;扫描件需要OCR。

01

选择 PDF 并提取文字

最多 50MB · 单次 200 页
TXT拖入文字型 PDF,或点击选择只读取PDF已有文字层;扫描件需要OCR
0 文件上传TXT UTF-8下载200 页/次NO OCR
提取步骤 / GUIDE

选页、核对、复制,
两分钟完成。

01

选择文字型PDF

支持未加密、50MB以内的PDF。

02

指定页面与标记

留空提取全部,也可填写1,3,5-8。

03

复制或下载TXT

先核对阅读顺序,再复制或保存UTF-8文件。

适用边界 / CHECK

先分清“文字层”,
再决定是否需要OCR。

TEXT

可选中文字:直接提取

如果PDF阅读器中能用鼠标选中文字,通常可以快速提取为纯文本。

SCAN

整页是图片:需要OCR

扫描件没有文字层时,本工具不会猜测内容,也不会把空结果冒充识别成功。

LAYOUT

纯文本不保留复杂版式

多栏、表格、脚注和竖排内容的阅读顺序可能变化,重要引用请对照原PDF核验。

隐私方式 / LOCAL

合同、报告和笔记,
不离开当前设备。

PDF字节、提取文字与生成TXT都只存在于当前浏览器标签页。本站不上传文档、不保存文字、不建立资料库,也不调用云端OCR。

PDF → TXTLOCAL零上传 · 无OCR · UTF-8
常见问题 / FAQ

提取之前,
先确认文字层、排版与编码。

PDF提取文字时文件会上传吗?

不会。PDF读取、页码选择、文字层提取、复制和TXT生成都在当前浏览器中完成,本站服务器不会收到文档内容。刷新或关闭标签页后,临时结果会被释放。

扫描版或图片型PDF能提取文字吗?

不能直接提取。此工具只读取PDF内部已有的文字层,不做OCR。若整页只是扫描图片,结果会为空;可先用PDF转PNG导出页面,再交给可信的OCR工具识别。

PDF有文字,为什么仍可能提取不到?

有些PDF把文字转成路径轮廓、使用异常字体编码,或只保存了页面图片,视觉上像文字但没有可读取文字层。这些情况通常需要OCR或原始编辑文件。

提取结果会保留原PDF排版吗?

不会完整保留。工具按PDF提供的文字项与换行提示生成纯文本,适合复制、检索和继续编辑;多栏、表格、脚注、竖排文字和复杂阅读顺序可能需要手动整理。

可以只提取指定页面吗?

可以。填写1,3,5-8等页码或范围;留空表示全部。一次最多处理200页,超长文档建议分批提取,便于核对和控制浏览器内存。

下载的TXT中文会乱码吗?

本站使用UTF-8编码并写入兼容标记,现代记事本、Office和代码编辑器通常能正确识别中文。若旧软件仍乱码,请在打开时手动选择UTF-8。

为什么默认加入页码分隔标记?

页码标记能帮助你核对引用来自PDF的哪一页。若只需要连续文字,可取消“页码分隔”,再重新提取。

加密或密码保护PDF能处理吗?

暂不支持,也不会要求你把PDF密码提交给本站。请由文件所有者先在可信软件中解除保护,再处理可正常打开的副本。