功能说明
把 PDF 的文本层转换成纯 HTML,包含标题、段落、列表和链接。输出没有样式,你可以直接放进自己的模板。保存文件之前请先查看预览。
<h1>会议记录</h1>
<p>项目概况和后续步骤。</p>
<ul>
<li>审阅草稿</li>
</ul>
使用场景
把报告放进内容管理系统、在网站上发布文档,或者把干净的标记提供给其他工具。发布之前请检查阅读顺序。
限制
没有文本层的扫描页面需要 OCR,本工具不包含 OCR。分栏、公式和表格可能会丢失结构。HTML 只保留文字,不保留页面设计。重要的内容请与 PDF 对照。
隐私
文件在你的浏览器中处理,不会为了转换而上传。导出的文件只分享给你信任的服务。
常见问题
HTML 会保留原来的排版吗?
不会。输出是没有样式的纯语义 HTML。请自己添加 CSS。
扫描版 PDF 可以用吗?
PDF 需要有可读的文本层。纯图片的扫描件需要 OCR,本工具不包含 OCR。
我的 PDF 文件会被上传吗?
转换在你的浏览器中运行。PDF 文件不会为了转换而上传。
输出示例
说明中的示例展示预期的输出内容,实际结果取决于你的文档。
<h1>会议记录</h1>
<p>项目概况和后续步骤。</p>
<ul>
<li>审阅草稿</li>
</ul>