关于 PDF2MD
我为什么做 PDF2MD,以及它能干什么、不能干什么——一个独立开发者的自我介绍。

关于 PDF2MD
我做这个工具,是因为自己工作里反复撞墙。市面上的转换器要么把文件传到我不信任的服务器,要么要我装一堆 Python 依赖。我不想这样,所以自己写了一个。
为什么有这个工具
我是一个独立开发者,平常做两件事:写小工具网站,和写 AI 相关的文章。
做网站的时候,我特别依赖 Claude Code。流程大致是:找一个想接入的 API,把官方文档喂给 Claude Code 做上下文。问题是大部分 API 文档要么是 PDF,要么是网页。直接复制粘贴进对话框,格式就乱了——标题不再是标题,代码块也变成普通文字。Claude 拿到结构化的 Markdown,写出来的代码质量明显高一截。所以我每天都要把 PDF 转成 Markdown 再贴。
写文章调研的时候,资料更杂。一个选题文件夹里通常有三四十个文件:网页剪藏、PDF 报告、偶尔还有别人发来的 Word 文档。要在这些资料里翻找、引用、做笔记,得统一格式才行。我读 Markdown 最舒服,于是所有东西都得先转成 Markdown。
试过几个现有工具。有的转换质量不错但要上传文件,有的免费但限制 10 页,还有的支持本地但要装一整套 Python 环境。批量转换这件事,几乎没人做得让我满意——我想要的是:拖二十个文件进去,出来二十个 Markdown。
干脆自己做一个。
工具能干什么
PDF2MD 完全在浏览器里跑。底层是 PDF.js,火狐浏览器内置的 PDF 渲染引擎就是它。文件不会离开你的电脑。没有上传环节。页面加载完之后断网,转换照样能用。
我自己用得最多的几个能力:
- 批量转换。 把整个调研文件夹拖进去,下载 zip。这是我做这个工具最主要的原因。
- 表格不丢。 大部分转换器把表格压扁成 "row1col1 row1col2" 的烂泥。PDF2MD 保留 Markdown 标准的管道符表格语法,方便我贴进 Obsidian 或者直接喂给 Claude。
- 没有大小限制。 我扔过 200 页的报告进去,会慢一点,但能转完。
- 不要账号,不要邮箱。 转个文件而已,凭什么要我留邮箱。
实话实说,搞不定的:扫描版 PDF。如果你的 PDF 是拍照或者扫描出来的(在阅读器里你不能选中文字),PDF2MD 没有 OCR,转出来就是空白。这种情况我会先单独跑一遍 OCR。要不要把 OCR 内置进来我犹豫过——加上去意味着浏览器要多下载一个几十 MB 的模型,整页变重,不太值。
我是谁
我叫 Ben,独立开发者,做小工具,写写 AI 相关的内容。这不是一家公司。PDF2MD 是这些小工具之一。日常使用——单文件、基础批量、每天转几份——都免费,因为浏览器端工具让别人用我没什么成本。重度使用有付费档(去广告、更大的批量 ZIP 下载、更高额度),帮我把维护和改进的时间撑下去。
哪里有 bug,或者想要什么功能,issues 在 github.com/littleben/pdf2md,邮箱 [email protected]。
就是这样。
最后更新:2026 年 2 月 18 日