这是什么网站?
Marklune 是一个在浏览器中运行的文档转换服务,可将 PDF 和其他文件转为结构化 Markdown。它面向需要把标题、列表、表格和版式信息转成可编辑、可归档或可接入 AI 工作流格式的人群。除文件转换外,网站还提供 HTML、JSON、电子表格、演示文稿和网页等类型的转换入口;需要程序化处理文档时,也可使用其 API。
核心功能
- 通过对应的格式转换器,将 PDF、Office 文档、HTML 和其他已列出的格式转换为 Markdown。
- 在源文件条件允许时,保留标题、列表、表格、引用块和代码块等文档结构。
- 为扫描件或纯图片 PDF 提供 OCR;官网称其支持 100 多种语言。
- 可将转换结果导出为 Markdown、结构化 JSON 或 HTML。
- 付费方案提供 REST API、Python 和 Node SDK、Webhook 及批量处理能力。
- 可在浏览器中免注册进行轻量使用;官网列出的免费额度为每月 50 页。
常见使用场景
- 开发者将 PDF 或 Office 文件转为 Markdown,供 LLM 或检索流程使用,让标题和表格不只是一段纯文本。
- 文档或知识库维护者在迁移到 Markdown 仓库、笔记系统前,先转换已有的源文件。
- 需要处理扫描记录的团队,对不含可选中文本的 PDF 使用 OCR 转换,再检查生成的 Markdown。
- 有持续文档接入需求的工程团队,通过 API、SDK、Webhook 或批量处理完成转换,不必逐个手动操作。
适合哪些用户?
- 需要把文档内容用于 Markdown、JSON 或 HTML 的开发者和 AI 工作流搭建者。
- 希望在 Markdown 类工具中复用文档内容的写作者、研究人员和知识工作者。
- 需要检查表格、标题等版式结构如何从原文件迁移过来的团队。
- 不太适合只需要无结构纯文本提取,或希望复杂版式无需人工复核即可完全还原的用户。
与同类工具的对比?
比较文档转换工具时,可以先区分纯文本提取和关注版式结构的转换,也要区分浏览器使用与 API 处理。Marklune 将结果定位为结构化 Markdown,并提供 JSON、HTML 导出;其网站强调标题、列表和表格的保留。面对具体工作流,仍应使用有代表性的文件测试,尤其是扫描页和复杂表格,并核对所需的处理量、输出格式、集成方式和人工复核流程是否与方案相符。
常见问题
- Q: Marklune 可以转换哪些文件?
- A: 官网列出的转换类别包括 PDF、Office 文档、HTML、JSON、电子表格、演示文稿、图像文件、电子书和网页。
- Q: Marklune 能处理扫描版 PDF 吗?
- A: 可以。其 FAQ 表示,扫描件和纯图片 PDF 会先通过内置 OCR 读取,再转换为 Markdown。
- Q: 可以导出哪些格式?
- A: Marklune 列出 Markdown、结构化 JSON 和 HTML 三种导出格式。
- Q: 有免费选项吗?
- A: 网站支持免注册的浏览器轻量使用,并列出每月 50 页的免费额度;更高处理量和 API 功能另有说明。







