将PDF文件转换为Markdown格式是一个非常实用的需求,尤其是在需要将内容从固定布局的PDF文件中提取出来,并转换为更易于编辑和处理的文本格式时。本文将介绍如何通过C#代码将PDF文档转换Markdown(MD)文档。
需要用到第三方库 Spire.PDF for .NET。
可以从以下链接下载产品包后手动添加引用,或者直接通过NuGet安装。
https://www.e-iceblue.cn/Downloads/Spire-PDF-NET.html
C# 将PDF转为Markdown文档
步骤:
- 创建
PdfDocument
类的对象 - 通过
LoadFromFile()
方法加载PDF文档; - 通过
SaveToFile(string filename, FileFormat.Markdown)
将加载的PDF文档转换为markdown文档。
示例代码:
using