老乡别走

|

6月前

|

机器学习/深度学习文字识别 Shell

高效率办公PDF批量处理：批量OCR识别PDF区域文字内容，用PDF内容批量改名或导出表格的货物运单应用案例

针对铁路货运物流单存档需求，本项目基于WPF与飞桨OCR技术，实现批量图片多区域文字识别与自动重命名。用户可自定义识别区域，系统提取关键信息（如车号、批次号）并生成规范文件名，提升档案管理效率与检索准确性，支持PDF及图像文件处理。

老乡别走

780 0 0

鱼的爱情看不出泪水

|

9月前

|

编译器 Python

如何利用Python批量重命名PDF文件

本文介绍了如何使用Python提取PDF内容并用于文件重命名。通过安装Python环境、PyCharm编译器及Jupyter Notebook，结合tabula库实现PDF数据读取与处理，并提供代码示例与参考文献。

鱼的爱情看不出泪水

336 1 1

小白学大数据

|

10月前

|

数据采集存储 API

Python爬虫结合API接口批量获取PDF文件

小白学大数据

703 0 0

一个幽默的程序员

|

12月前

|

存储 JSON API

如何将 Swagger 文档导出为 PDF 文件

你会发现自己可能需要将 Swagger 文档导出为 PDF 或文件，以便于共享和存档。在这篇博文中，我们将指导你完成将 Swagger 文档导出为 PDF 格式的过程。

一个幽默的程序员

1017 0 0

Undoom

|

11月前

|

人工智能算法安全

使用CodeBuddy实现批量转换PPT、Excel、Word为PDF文件工具

通过 CodeBuddy 实现本地批量转换工具，让复杂的文档处理需求转化为 “需求描述→代码生成→一键运行” 的极简流程，真正实现 “技术为效率服务” 的目标。感兴趣的快来体验下把

Undoom

634 10 10

蚝油菜花

|

人工智能编解码文字识别

OCRmyPDF：16.5K Star！快速将 PDF 文件转换为可搜索、可复制的文档的命令行工具

OCRmyPDF 是一款开源命令行工具，专为将扫描的 PDF 文件转换为可搜索、可复制的文档。支持多语言、图像优化和多核处理。

蚝油菜花

1354 17 17

OCRmyPDF：16.5K Star！快速将 PDF 文件转换为可搜索、可复制的文档的命令行工具

蚝油菜花

|

机器学习/深度学习人工智能文字识别

Zerox：AI驱动的万能OCR工具，精准识别复杂布局并输出Markdown格式，支持PDF、DOCX、图片等多种文件格式

Zerox 是一款开源的本地化高精度OCR工具，基于GPT-4o-mini模型，支持PDF、DOCX、图片等多种格式文件，能够零样本识别复杂布局文档，输出Markdown格式结果。

蚝油菜花

1524 4 4

Zerox：AI驱动的万能OCR工具，精准识别复杂布局并输出Markdown格式，支持PDF、DOCX、图片等多种文件格式

老乡别走

|

文字识别 Serverless 开发工具

【全自动改PDF名】批量OCR识别提取PDF自定义指定区域内容保存到 Excel 以及根据PDF文件内容的标题来批量重命名

学校和教育机构常需处理成绩单、报名表等PDF文件。通过OCR技术，可自动提取学生信息并录入Excel，便于统计分析和存档管理。本文介绍使用阿里云服务实现批量OCR识别、内容提取、重命名及导出表格的完整步骤，包括开通相关服务、编写代码、部署函数计算和设置自动化触发器等。提供Python示例代码和详细操作指南，帮助用户高效处理PDF文件。链接： - 百度网盘：[链接](https://pan.baidu.com/s/1mWsg7mDZq2pZ8xdKzdn5Hg?pwd=8866) - 腾讯网盘：[链接](https://share.weiyun.com/a77jklXK)

老乡别走

2104 5 5

蚝油菜花

|

人工智能文字识别数据挖掘

MarkItDown：微软开源的多格式转Markdown工具，支持将PDF、Word、图像和音频等文件转换为Markdown格式

MarkItDown 是微软开源的多功能文档转换工具，支持将 PDF、PPT、Word、Excel、图像、音频等多种格式的文件转换为 Markdown 格式，具备 OCR 文字识别、语音转文字和元数据提取等功能。

蚝油菜花

3780 9 9

MarkItDown：微软开源的多格式转Markdown工具，支持将PDF、Word、图像和音频等文件转换为Markdown格式

哈你真皮

|

JavaScript

jquery图片和pdf文件预览插件

EZView.js是一款jquery图片和pdf文件预览插件。EZView.js可以为图片和pdf格式文件生成在线预览效果。支持的文件格式有pdf、jpg、 png、jpeg、gif。

哈你真皮

438 16 16

文字识别

热门文章

最新文章

相关电子书