Pandoc
通过统一文档抽象语法树在 Markdown、DOCX、HTML、EPUB、LaTeX、PPTX 等多种标记和文档格式之间转换的命令行工具。
Pandoc 的转换模型
Pandoc 是通用标记格式转换器,由读取器、内部抽象语法树和写入器组成。它支持 Markdown、DOCX、HTML、EPUB、LaTeX、PPTX、Jupyter Notebook、Org、reStructuredText 等多种输入与输出,也能通过模板和过滤器定制中间结构。
结构优先不等于排版无损
不同文档格式能表达的内容并不相同。Pandoc 会尽量保留标题、段落、列表、引用等结构,但复杂表格、文本框、精确页边距、宏与专有样式可能降级。应保留权威源文件,并对生成文档的内容、链接、字体和排版逐项检查。
PDF 与过滤器需要额外信任
PDF 输出通常依赖单独安装的 LaTeX、HTML 或其他引擎。外部过滤器会作为程序运行,Lua 过滤器也属于代码;来源不明的过滤器、模板和资源不应直接用于机密文档。自动化中应固定版本、在隔离目录运行并避免覆盖输入。
维护记录
本页于 2026-08-06 根据 Pandoc 的读取器/写入器架构、格式列表、转换损失、PDF 引擎和过滤器说明复核。归档文件为 3.10.1 Windows x64 MSI,许可证为 GPL 2.0 或更高版本。
选择下载方式
下载前请核对资源版本和授权范围。本站不提供破解软件及未经授权的资料。
Pandoc Windows 文档转换教程
先对不含隐私的简单 Markdown 文件做单向转换,再逐项加入图片、表格、引用和模板。始终保留源文件,不要用转换结果覆盖唯一原件。
安装前准备
- 准备一份包含标题、列表、链接、图片和简单表格的测试文档,并保留原始副本。
- 明确输入与输出格式,尤其是扩展名不足以区分 Markdown 方言或模板行为时。
- 如需 PDF,提前选择并单独安装受支持的 PDF 引擎,同时评估字体和中文排版。
安装步骤
- 01
安装 Windows MSI
核对版本和 x64 架构后运行 MSI,完成后打开新终端,通过版本命令确认 pandoc 已加入可执行路径。
- 02
创建隔离测试目录
只复制示例文档和资源到测试目录,避免转换命令递归读取或覆盖真实工作文件。
- 03
确认目标工具链
DOCX、EPUB 与 HTML 可先直接测试;PDF 输出则先验证所选引擎、字体和环境变量均可用。
快速上手
- 01
转换简单 Markdown
指定输入 Markdown 与新的 HTML 或 DOCX 输出文件,执行后检查标题、列表、链接、代码块和中文字符。
- 02
增加复杂元素
逐项加入图片、表格、脚注和引用,每次转换都比较差异,定位哪个元素在目标格式中降级。
- 03
固定可重复命令
确认结果后再明确写出输入格式、输出格式、资源路径和模板版本,并在脚本中始终输出到新目录。
使用建议
- 文档往返转换通常会累积损失,应确定一个权威源格式,不要反复在 DOCX 与 Markdown 之间来回保存。
- 自定义 Lua 或外部过滤器可以处理抽象语法树,但也能执行代码,必须固定来源和版本。
- 处理机密文档时检查临时文件、图片提取目录、命令历史和生成产物,不要把内容发送给未知在线服务。
故障排查与卸载方法
生成 PDF 时提示找不到引擎怎么办?
安装并配置受支持的 PDF 引擎,确认其命令在新终端 PATH 中可用;同时检查字体和目标语言包。
DOCX 转 Markdown 后排版变化怎么办?
这是格式模型差异导致的常见损失。先识别复杂表格、文本框和样式,调整转换策略或保留原格式,不要假设可以自动还原。
- 卸载 Pandoc 与附加引擎通过系统应用管理卸载 Pandoc;LaTeX 或其他 PDF 引擎是独立软件,需要按各自方式处理。清理前保留源文档和可复现命令。
常见问题
Pandoc 能无损转换任意文档格式吗?
不能。Pandoc 优先保留文档结构,而不同格式的表达能力并不相同;页边距、复杂表格、文本框、批注、宏和精细排版可能丢失或改变,必须人工复核输出。
安装 Pandoc 后可以直接生成 PDF 吗?
Pandoc 可以生成 PDF,但通常需要另外安装 LaTeX、HTML、Groff 或其他受支持的 PDF 引擎。只有 Pandoc MSI 并不等于具备完整 PDF 工具链。
Pandoc 过滤器和模板安全吗?
自定义过滤器属于可执行代码,模板和资源也会影响输出。不要直接运行来源不明的过滤器、脚本或复杂构建命令,应在低权限隔离目录审查和测试。
下载时需要提取码吗?
夸克网盘无需提取码;百度网盘所需的四位提取码会直接显示在下载入口旁。
