获取要搜索的文本
从文本分层 PDF 导出 TXT 以查找短语或包含在文字处理工作流程中。
PDF 工具
正在准备…
请稍候。
将 PDF 内容导出到文件 TXT 或 RTF。。支持最大 256 MB 的单个文件,无需注册。
选择一个文件 · 最大 256 MB
文件受到保护并会自动删除指南
只需三步,即可将源文档处理成您需要的结果。
为您的文档选择合适的处理任务。
拖放文件,或直接从设备中选择。
查看处理进度,并在文件准备好后下载。
无需账户、无需安装,也没有多余步骤。
只有当前会话可以访问您的文件。
输入文件和处理结果将在一小时后失效。
了解此工具
PDF 到文本转换器从 PDF 文件中获取最多 256 MB 的文本内容,并将其输出到 TXT 或 RTF。 TXT适合搜索、解析或粘贴纯文本到另一个系统。 RTF 保留部分格式以便使用编辑器打开。该工具最适用于已经具有可以选择和复制的文本图层的 PDF 文件。
在具有多个列、表格或文本框的文档中,提取顺序可能与页面上的阅读顺序不同,因为 PDF 并不总是清楚地存储语义结构。该工具本身不运行OCR。如果文件是扫描件或照片,结果可能是空白或只有很少的文本。首先将OCR制作为PDF文件,然后提取TXT或RTF并检查识别错误。
从文本分层 PDF 导出 TXT 以查找短语或包含在文字处理工作流程中。
选择 RTF 在编辑器中打开内容并保留一些基本格式。
将文档内容提取到紧凑文件中以进行比较、分类或注释。
实用建议
常见问题
TXT 包含纯文本,不保留字体样式、颜色、表格或对齐方式,因此文件紧凑且易于用于搜索或处理数据。 RTF 可以保留一些基本格式并在许多编辑器中打开。两种格式都取决于源 PDF 文件中可用的文本层和阅读顺序。
PDF 文件可能仅包含页面的扫描图像,而不包含要提取的文本层。 PDF 转文本工具不会自动运行 OCR。请先使用OCR PDF,根据内容选择越南语、英语或两者。然后,将文件 OCR 转换为 TXT 或 RTF 并检查是否有误识别的字符。
PDF可以按照显示位置而不是阅读顺序保存每段文本。提取时,该工具必须从内部结构推断顺序,因此多个列、表格或文本框中的内容可能会交错。 RTF有时更容易阅读,但您仍然需要将其与源PDF文件进行比较。
访问权限将在一小时后失效,系统每五分钟清理一次。请在结果失效前下载您需要的文件。