将 PDF 转化为 Word 文件

简介: 将 PDF 转化为 Word 文件

简介

最近存在一个问题:项目结题申请需要上交 Word 版本结题报告。然后我是使用 LaTeX 制作的报告,只能生成 PDF 文件。这该怎么办?通过互联网检索发现了以下几种方法:

  1. 通过在线网站/软件将 PDF 直接转化为 Word 格式 (效果不好)
  2. 使用 Pandoc 将 Tex 源文件转化为 Word 格式

下面分别介绍使用方法:

注意本文是在学习过程中记录的笔记。小编觉得读者可能也会存在这样的需求,所以进行了分享。如果您觉得有其他更好的方式,欢迎留言分享。如果您觉得有用,欢迎一键三连。

通过在线网站/软件将 PDF 直接转化为 Word 格式

可以使用在线网站进行转化,但是效果都不是很好。公式、排版都存在问题。这种方式不合适。


搜索关键词:pdf 转 word

使用 Pandoc 将 Tex 源文件转化为 Word 格式

该教程来源于CSDN[1],小编根据该教程在 mac 中进行学习和实践。

  1. 将 TeX 的源文件夹(例如:psalt-latex)拖入终端。


  1. 输入以下代码,并根据自身情况进行修改。具体如何修改见下面参数介绍。

pandoc psalt.tex -o output.docx -w docx \
       --reference-doc template.docx \
       --filter pandoc-crossref \
       --bibliography=ref.bib \
       --citeproc \
       --csl aims-mathematics.csl


操作界面

参数包含,来自推文[2]

  • paslt.tex:输入 LaTeX 文件名
  • -o output.docx:输出 Word 文件名
  • -w docx:输出文件格式
  • --reference-doc template.docx:参考模板 Docs 文件 【可选】
  • --filter pandoc-crossref:用于交叉引用(公式、引文)的过滤器 【可选】,下载地址:GitHub[3],必须找到与已安装 pandoc 版本对应的可执行文件,下载后放在运行此命令的同一目录下(对于 Windows 和 macOS)
  • --bibliography ref.bib:参考文献 bib 文件 【可选】
  • --citeproc:用于参考文献的引用 【可选】
  • --csl aims-mathematics.csl:参考文献样式文件,可从 Zotero Style[4] 官网挑选需要样式下载 【可选】


Zotero Style 官网

按 Enter 稍等片刻即可转成 Word 文件!



Word 文件预览

通过这种方法得到的图形和公式基本不需要再处理了~

注意:如果有对应期刊的参考模板 Docs 文件,效果会更好些。Windows 的处理方式类似,读者可以自行转化。

小编有话说

  1. 本文是在学习过程中记录的笔记。小编觉得读者可能也会存在这样的需求,所以进行了分享。如果您觉得有其他更好的方式,欢迎留言分享。如果您觉得有用,欢迎一键三连。
  2. 噢对~小编来分享个好消息,最近参加方向相关的国际会议,很幸运拿到了最佳学生论文奖😊。之后会整理如何使用英语汇报自己的学术成果,汇报模板等内容。
  3. 可能很多读者是通过 R 语言关注我的,但是最近发的内容主要是平常科研存在的小技巧和科研者成长的相关内容。大家不要担心,等事情少了,R 语言相关的内容还会继续发布的~

参考资料

[1]

CSDN: https://blog.csdn.net/qq_31375855/article/details/122044004

[2]

推文: https://blog.csdn.net/qq_31375855/article/details/122044004

[3]

GitHub: https://github.com/lierdakil/pandoc-crossref/releases

[4]

Zotero Style: https://www.zotero.org/styles

目录
相关文章
|
9天前
|
人工智能 编解码 文字识别
OCRmyPDF:16.5K Star!快速将 PDF 文件转换为可搜索、可复制的文档的命令行工具
OCRmyPDF 是一款开源命令行工具,专为将扫描的 PDF 文件转换为可搜索、可复制的文档。支持多语言、图像优化和多核处理。
129 17
OCRmyPDF:16.5K Star!快速将 PDF 文件转换为可搜索、可复制的文档的命令行工具
|
5天前
|
文字识别 BI
【图片型PDF】批量识别扫描件PDF指定区域局部位置内容,将识别内容导出Excel表格或批量改名文件,基于阿里云OCR对图片型PDF识别改名案例实现
在医疗和政务等领域,图片型PDF文件(如病历、报告、公文扫描件)的处理需求广泛。通过OCR技术识别这些文件中的文字信息,提取关键内容并保存为表格,极大提高了信息管理和利用效率。本文介绍一款工具——咕嘎批量OCR系统,帮助用户快速处理图片型PDF文件,支持区域识别、内容提取、导出表格及批量改名等功能。下载工具后,按步骤选择处理模式、进行区域采样、批量处理文件,几分钟内即可高效完成数百个文件的处理。
37 8
|
26天前
|
机器学习/深度学习 人工智能 文字识别
Zerox:AI驱动的万能OCR工具,精准识别复杂布局并输出Markdown格式,支持PDF、DOCX、图片等多种文件格式
Zerox 是一款开源的本地化高精度OCR工具,基于GPT-4o-mini模型,支持PDF、DOCX、图片等多种格式文件,能够零样本识别复杂布局文档,输出Markdown格式结果。
100 4
Zerox:AI驱动的万能OCR工具,精准识别复杂布局并输出Markdown格式,支持PDF、DOCX、图片等多种文件格式
|
2月前
|
人工智能 文字识别 数据挖掘
MarkItDown:微软开源的多格式转Markdown工具,支持将PDF、Word、图像和音频等文件转换为Markdown格式
MarkItDown 是微软开源的多功能文档转换工具,支持将 PDF、PPT、Word、Excel、图像、音频等多种格式的文件转换为 Markdown 格式,具备 OCR 文字识别、语音转文字和元数据提取等功能。
315 9
MarkItDown:微软开源的多格式转Markdown工具,支持将PDF、Word、图像和音频等文件转换为Markdown格式
|
2月前
|
JavaScript
jquery图片和pdf文件预览插件
EZView.js是一款jquery图片和pdf文件预览插件。EZView.js可以为图片和pdf格式文件生成在线预览效果。支持的文件格式有pdf、jpg、 png、jpeg、gif。
68 16
|
4月前
|
Java Apache Maven
将word文档转换成pdf文件方法
在Java中,将Word文档转换为PDF文件可采用多种方法:1) 使用Apache POI和iText库,适合处理基本转换需求;2) Aspose.Words for Java,提供更高级的功能和性能;3) 利用LibreOffice命令行工具,适用于需要开源解决方案的场景。每种方法都有其适用范围,可根据具体需求选择。
|
4月前
|
Java Apache Maven
Java将word文档转换成pdf文件的方法?
【10月更文挑战第13天】Java将word文档转换成pdf文件的方法?
1221 1
|
4月前
|
计算机视觉 Python
Python操作PDF文件
Python操作PDF文件
64 1
|
4月前
|
JavaScript 前端开发 容器
Vue生成PDF文件攻略:html2canvas与jspdf联手,中文乱码与自动换行难题攻克
Vue生成PDF文件攻略:html2canvas与jspdf联手,中文乱码与自动换行难题攻克
387 0
|
4月前
|
索引 Python
PDF文件页面提取操作小指南
PDF文件页面提取操作小指南
131 4

热门文章

最新文章