转换为 HTML
将 14 种文档格式转为干净的独立 HTML——带正确 DOCTYPE、head 和 body 结构。Pandoc writer 产出语义化标记,不是 div 堆砌。
点击开始转换
跳转到 Pandoc 引擎,自动选择 HTML 输出
支持的输入格式
| 格式 | 扩展名 | 说明 |
|---|---|---|
| Word (docx) | .docx | 标题、表格、脚注、图片、修订痕迹 |
| LibreOffice (odt) | .odt | 段落样式、母版页、内嵌媒体 |
| 电子书 (epub) | .epub | 章节结构、书籍元数据、图片 |
| HTML | .html | 标题、列表、表格、链接——真正的 HTML reader |
| LaTeX | .tex | 数学、环境、引文 |
| reStructuredText | .rst | 指令、role、表格 |
| Org-mode | .org | 标题、属性、抽屉块 |
| CSV | .csv | Pandoc 渲染为 GFM 管道表格 |
| TSV | .tsv | 制表符分隔,渲染为管道表格 |
| MediaWiki | .mediawiki | 模板、链接、表格 |
| DocBook | .docbook | 文章、章节、媒体对象 |
| OPML 大纲 | .opml | 嵌套大纲 → 标题层级 |
| Jupyter notebook | .ipynb | 代码 cell、输出、Markdown cell |
转换是怎么工作的
Pandoc 的 reader 先把文档解析成语义树,HTML writer 再把它序列化为干净的标准标记:真正的 h1–h6 标题、table 元素、带题注图片的 figure 元素、语义化的强调标签,而不是一堆内联样式。
输出是独立完整的文档——DOCTYPE、带 UTF-8 声明的 head 和 body。没有任何 Word 导出遗留物:没有 mso- 条件注释、没有内联字体声明,也不用再写 20 行正则去清理。
和本站所有转换一样,它在浏览器内的 WebAssembly Worker 中运行,文件始终留在你的设备上。
常见问题与解决办法
输出的 HTML 是刻意不带样式的——纯语义标记、没有 CSS。直接粘进 CMS,或套上你自己的样式表;需要内联样式的话在转换后加 class。
LaTeX 公式可以用 MathJax、KaTeX 或 MathML 渲染——转换前在选项面板里选好方式;如果目标系统自带公式渲染,也可以选纯文本保留。
围栏代码块由 Pandoc 按你选择的主题做语法高亮。图片以相对路径引用;从 docx 转换时请用 ZIP 下载,media/ 文件夹会随 HTML 一起打包。
谁在用这个页面
把排好版的 Word 内容粘进接受 HTML 的 CMS 编辑器的作者、把操作手册变成帮助中心文章的客服团队,以及把生成的文档片段嵌入 Web 应用或邮件简报的开发者。
转换为 HTML 常见问题
+输出是独立 HTML 文件还是片段?
独立文件。Pandoc 产出带 DOCTYPE、<head> 和 <body> 的完整 HTML 文档——可直接在浏览器打开或上传到 CMS。
+能将 Word 文档转为 HTML 吗?
能。拖入 .docx 选择 HTML 输出,标题、表格、脚注、图片全部保留。结果是干净的语义化 HTML,不是 Word 的导出混乱。
+LaTeX 数学公式怎么处理?
Pandoc 可将 LaTeX 数学渲染为 MathJax、KaTeX、MathML 或纯文本,在选项面板中选择渲染方式。
+支持语法高亮吗?
支持。Pandoc 用所选主题高亮围栏代码块——pygments、kate、monochrome 等。