首页
学习
活动
专区
圈层
工具
发布
    • 综合排序
    • 最热优先
    • 最新优先
    时间不限
  • 来自专栏小明的数据分析笔记本

    小技巧:多个pdf文件合并及pdf文件添加页码

    扫描文件的时候每一页都是单独保存的,这个时候我想把他们合并成一个完整的pdf文件,借助Adobe Acrobat Pro DC 这个软件可以很方便的实现 直接选中需要合并的文件点击右键 选择在Acrobat image.png 给pdf文件添加页码,这里借助万彩办公大师,万彩办公大师真是一个良心软件,有很多功能,还是免费的,单单处理pdf文件的功能就有一大堆, ? 添加页码 ? image.png 非常方便 欢迎大家关注我的公众号 小明的数据分析笔记本 小明的数据分析笔记本 公众号 主要分享:1、R语言和python做数据分析和数据可视化的简单小例子;2、园艺植物相关转录组学、 其他的一些资料 LD计算和作图 https://www.royfrancis.com/fast-ld-computation-from-vcf-files-using-tomahawk/ R语言ggplot2一幅好看的热图

    4K20发布于 2021-07-12
  • 来自专栏算法工程师的学习日志

    使用python合并多个pdf文件

    今天需要整理一份资料,需要把多个pdf合并为一个,wps这些软件自然是有这个功能,但一般都是收费的,百度上也有很多网站,但资料上传到别人的网站,始终觉得还是不太可靠,故自己搜索了一下使用python来处理 pdf文件,故此分享这个方法 python处理pdf需要用到一个PyPDF2的库,故首先安装这个第三方库 安装这些第三方库推荐使用国内的源,比如清华、豆瓣、百度、华为等 pip install PyPDF2 -i https://pypi.tuna.tsinghua.edu.cn/simple 然后根据这个库处理pdf import os from PyPDF2 import PdfFileMerger target_path = r'pdf' ## pdf目录文件 pdf_lst = [f for f in os.listdir(target_path) if f.endswith('.pdf' (r"合并文件.pdf") 注意一下: 合并的时候,pdf_lst 是根据文件的名称来排序生成,如果对于pdf文件合成顺序有要求,建议吧文件按照期望的合成顺序编号1 2 3这样,方便一些 比如像下面这种

    3.8K10编辑于 2022-07-27
  • 来自专栏Python小屋

    使用Python合并任意多个PDF文件

    在工作中,经常会遇到合并pdf文件的需求,这时候你会发现不是一件很容易完成的任务。包括WPS、福昕阅读器在内的很多软件都有合并pdf文件的功能,但是只有交钱变成会员之后才能使用,否则只能合并3页。 有不少网站提供了在线合并pdf文件的功能,但也是必须交钱才能用。还有的显示合并成功,但就是无法下载。如果你会一点Python,就会发现这是一件很容易的事,并且不用花一分钱。 功能描述: 使用Python合并任意多个PDF文件。 详细步骤: 1、安装扩展库PyPDF2。 ? 2、编写代码。 ? 3、把代码中pdf_files的内容改成自己要合并pdf文件名,运行代码,一眨眼,合并完成。

    6K20发布于 2019-12-25
  • 来自专栏CSDNToQQCode

    表单一次性上传多个文件

    html file类型如何一次性上传多个文件 <! -- 按住CTRL挨个选择,或者鼠标框选都行 --> <input type="file" name="file" multiple="multiple"/> 选择了8个文件

    1.7K20编辑于 2022-11-29
  • 来自专栏疯狂学习GIS

    PowerShell一次性替换多个文件的名称

      本文介绍基于PowerShell语言,对文件夹中全部文件的名称加以批量替换、修改的方法。   在之前的文章再也不怕重命名班级同学文件! 基于Python批量重命名文件方法中,我们介绍了基于Python语言,批量修改大量文件的名称的方法。 本文就介绍基于PowerShell语言,批量修改文件夹中大量文件的名称的方法。   首先,来看一下我们的需求。 现有一个文件夹,如下图所示,其中我们需要修改全部文件文件名;修改的规则是,将原有每一个文件的名称中的字段CRO修改为GRA。   知道了需求,接下来我们即可开始具体操作。 此时,可以看到文件夹中的文件都已经是重命名之后的了。   

    3.2K20编辑于 2023-10-24
  • 使用ElementUI el-upload一次性上传多个文件

    在日常的前端开发中,文件上传是一个非常常见的需求,尤其是在用户需要一次性上传多个文件的场景下。 这个组件不仅能满足单文件上传的需求,还能轻松实现一次性上传多个文件。更重要的是,el-upload组件的API设计非常简洁明了,开发者可以根据自己的需求进行灵活配置。 实现多文件上传为了实现一次性上传多个文件,我们只需要在el-upload组件中设置multiple属性即可。该属性允许用户在文件选择对话框中一次性选取多个文件。 $refs.upload.submit(); } } }</script>在这个示例中,我们添加了multiple属性,使得文件选择对话框允许一次性选择多个文件。 小结ElementUI的el-upload组件为我们提供了强大的文件上传功能,不仅支持单文件上传,还可以轻松实现一次性上传多个文件

    9.2K11编辑于 2024-07-02
  • 来自专栏sktj

    python 查找多个目录下的最大Python文件 脚本

    os.environ['PYTHONPATH']: this is a subset of sys.path. """ import sys, os, pprint trace = 0 # 1=dirs, 2=

    2.2K30编辑于 2022-05-13
  • 来自专栏完美Excel

    Excel实战技巧43: 将多个PDF文件中指定页面合并成一个PDF文件

    学习Excel技术,关注微信公众号: excelperfect 在《Python实战01:合并多个PDF文件》和《Python实战02:分别合并多个相似文件名的PDF文件》中,我们使用Python代码对 PDF文件进行操作来合并PDF文件。 其实,使用VBA也能合并PDF文件。 假设在同一文件夹中放置了要合并的PDF文件所在的文件夹、合并后的文件存放的文件夹、以及代码工作簿,其中要合并的文件存放在名为“PDF文件”的文件夹中,合并后的文件放在名为“合并的文件”的文件夹中,如下图 例如,数字2表明要合并文件“完美Excel.pdf”的第2页,数字2,6表明要合并文件“汇总.pdf”的第3页和第6页,如下图4所示。 ?

    7.9K72发布于 2019-07-19
  • 来自专栏技术杂货店

    Mybatis【2】-- 多个mapper文件以及namespace作用

    多个mapper文件以及namespace作用 pexels-johannes-plenio-1435075 多个mapper文件以及namespace作用 要是多个mapper文件的时候怎么处理 ,这个文件里面配置的都是整个项目与数据库相关的配置,比如运行的时候的数据库环境(连接哪一个数据库,数据库服务器的地址,用户名,密码),或者是配置外部配置文件等,最重要的是,这个文件注册了映射文件(mapper ("insertStudent",student);,就会去查找每一个mapper里面的sql配置语句,也就是类似于下面这种: <mapper namespace="mapper1"> <insert 否则会报以下错误: 多个mapper文件,在在mybatis.xml文件里面需要注册两个文件: <! ="mapper/mapper<em>2</em>.xml"/> </mappers> 使用时候加上namespace: 此文章仅代表自己(本菜鸟)学习积累记录,或者学习笔记,如有侵权,请联系作者删除。

    1.3K20编辑于 2022-02-15
  • 来自专栏囍楽云博客

    pdf文件用什么方式打开-pdf是什么格式的文件用什么打开(教你2种方法打开pdf文件

      平时办公和学习生活中我们会经常使用到PDF文件,比如有编辑好的Word、PPT文件需要打印和保存的时候,将Word、PPT转换成PDF文件就能很好地保留原文件格式;或者把Excel文件转换成PDF文件来保存 那么PDF文件该怎么打开浏览呢?如何打开和查看PDF文件?   首先可以利用电脑里面的办公软件来把PDF文件打开,进行浏览等操作。 打开办公软件pdf文件用什么方式打开,点击打开文件的选项,在电脑里找到你要阅读的PDF文件打开就可以了。    还有一种方法,在电脑里准备专门的PDF阅读工具,运行该工具,在工具里找到目标PDF文件并打开,就能浏览PDF文件了。还可以调整阅读页面的大小,或对PDF文件进行一些基本的编辑操作。 本文共 434 个字数,平均阅读时长 ≈ 2分钟

    3.4K30编辑于 2022-12-26
  • 来自专栏Dance with GenAI

    零代码编程:用ChatGPT来批量合并多个PDF文件

    一个文件夹里面有38个PDF文件,现在想合并成一个PDF文件。用ChatGPT可以非常简单的实现。 在ChatGPT中输入提示词如下: 这两个文件夹里面有多个PDF文件,写一段Python程序,将文件夹里面的PDF文件按照文件标题名合并成一个PDF文件,然后保存到文件夹中 F:\BaiduNetdiskDownload 没有找到PDF文件。") \\小兔兵兵第2季绘本" merge_pdfs(folder1, "小兔兵兵第1季绘本合并.pdf") merge_pdfs(folder2, "小兔兵兵第2季绘本合并.pdf") 程序运行正常: 打开合并后的 PDF文件,合并正确:

    55410编辑于 2024-06-24
  • 专利信息自动整理实战——多个PDF文件,一张Excel表

    专利信息自动整理实战——多个PDF文件,一张Excel表手头有多个专利PDF要分析,、老板说要整理成Excel对比表,把专利名称,专利权人,摘要,摘要图片等列出来,便于快速分析该领域的专利。 打开PDF想手抄?摘要300多字,两个文件加起来就是一篇小作文。 还说要摘要附图……以前都是一个一个PDF打开,复制专利名称,专利权人,复制摘要,复制摘要图片,再打开下一个PDF,继续复制复制,打开打开,好多个PDF干下来,人都麻木了。用workbuddy,太快了。 工作流程分析工作流程:PDF→提取(专利名称,专利权人,摘要,摘要图片)→写入Excel表格前置准备把所有专利PDF放进同一个文件夹,路径不要含特殊符号、中文空格;确认专利是可复制文字版PDF(扫描件需要开启 一句话话搞定请分析附件中的专利PDF,提取首页信息到Excel。结果输出:小结workbuddy很强大,找对了工具,工作效率飞起,以后任何时候再碰到专利PDF要整理,几秒钟就出结果。

    25710编辑于 2026-06-14
  • 来自专栏数据处理与编程实践

    VBA: Excel文件批量转化为pdf (2)

    文章背景:测试仪器的数据有些会以Excel文件的形式保存,有时需要将测试数据转化为pdf格式。 上篇文章(见文末的延伸阅读)通过VBA代码,采用ExportAsFixedFormat函数将excel文件转化为pdf文件,对于部分excel文件的转化效果不太好,有些谱图显示不完整,如下图所示。 经过几次尝试后发现,如果是采用另存为的方式导出为pdf文件,部分谱图会出现乱码,而通过虚拟打印机(Adobe PDF或Microsoft Print to PDF)的方式将excel文件打印输出为pdf Exit Sub End If End With '2 创建储存pdf文件的空文件夹 filefolder = ThisWorkbook.Worksheets Exit Sub End If '3 批量转化excel文件 str = Dir(t & "\*.xls*") ' 查找excel文件 Do While

    3.7K10编辑于 2022-09-20
  • 来自专栏实用技术

    在python中有多个对应的库可以操作Pdf文件,其中最常用的是Pypdf2

    PDF是Portable Document Format的简称,意为“可携带文档格式”,是由Adobe Systems用于与应用程序、操作系统、硬件无关的方式进行文件交换所发展出的文件格式。 在python中有多个对应的库可以操作Pdf文件,其中最常用的是Pypdf2PyPDF是一个操作pdf的模块,现在最常用的版本是PyPDF2;需要注意的是,这个库不能操作pdf获取文字信息PyPDF2介绍 PyPDF2PyPdf2中有两个模块,分别是:读取库 PDFFileReader操作库 PdfFileWriter1、使用PDFFileReader可以获取pdf文件的基本信息,还可以获取到每一页pdf 对象,传入文件路径infomation = pdf.getDocumentInfo() #获取文档信息number_of_pages = pdf.getNumPages() #获取总页数完整实例代码如下 reader对象,传入文件路径#pdf = pdf.decrypt('password') #对加密的文件机密infomation = pdf.getDocumentInfo() #获取文档信息number_of_pages

    1.9K10编辑于 2022-07-04
  • 【拆分PDF重命名】将PDF按页拆分多个PDF文件,并用PDF里文字对文件批量重命名,python和腾讯api识别改名的完整代码和详细步骤

    一个典型的场景是,一个多页的 PDF 文件包含了多个不同主题或信息单元,而用户希望将其按页拆分成多个单独的 PDF 文件,以便于更方便地管理、存储和检索这些信息。 以下是使用 Python 和腾讯云 OCR API 实现将 PDF 按页拆分多个 PDF 文件并用 PDF 里文字对文件批量重命名 完整步骤和代码示例: 步骤 1:准备工作 安装必要的库: PyPDF2 pdf2image:用于将 PDF 页面转换为图像,以便进行 OCR 识别。同时需要安装 Poppler 工具,pdf2image 依赖它来处理 PDF 文件。 (input_pdf_path): """ 将 PDF 按页拆分为多个 PDF 文件 :param input_pdf_path: 输入的 PDF 文件路径 :return 然后在终端中运行以下命令: bash python pdf_split_and_rename.py 代码说明 split_pdf 函数:将输入的 PDF 文件按页拆分为多个单独的 PDF 文件

    4.6K10编辑于 2026-06-22
  • 来自专栏生信小驿站

    python日常技巧(2)将pdf文件中的表格转化成csv文件

    前文介绍 从 PDF 表格中提取表格数据时比较困难的。不久前,一位开发者提供了一个名为 Camelot 的工具,满足大家从 PDF 文件中提取表格数据。 使用pip 安装依赖包(包括Tkinter和ghostscript)之后,可以简单地使用pip安装Camelot: pip install camelot-py[cv] (2)示例 # -*- coding camelot import os os.chdir('D:\\pywork\\shuiyin') # In[*] >>> import camelot >>> tables = camelot.read_pdf ('foo.pdf') #类似于Pandas打开CSV文件的形式 # In[*] >>> tables[0].df # get a pandas DataFrame! html, sqlite,可指定输出格式 >>> tables[0].to_csv('foo.csv') # to_json, to_excel, to_html, to_sqlite, 导出数据为文件

    3.9K20发布于 2019-11-21
  • 来自专栏Dance with GenAI

    零代码编程:用ChatGPT提取PDF文件一页中的多个表格

    零代码编程:用ChatGPT提取PDF文件一页中的多个表格 一个PDF文件中,有好几个表格,要全部提取出来,该怎么做呢? F盘的“艾能聚1.xlsx”; 保存第2个表格到F盘的“艾能聚2.xlsx“; 保存第3个表格到F盘的“艾能聚3.xlsx“; 注意:每一步都要输出信息 ChatGPT生成的代码如下: import os save_to_excel(data, file_path): df = pd.DataFrame(data) df.to_excel(file_path, index=False) print(f"表格内容已保存到文件 (file_path) as pdf: for i, page_num in enumerate(page_num_list): page = pdf.pages[page_num - 1] tables = r"F:\北交所全部上市公司的招股说明书20230710\艾能聚.pdf" page_num_list = [174] output_folder = r"F:" extract_tables_from_pdf

    79410编辑于 2024-06-24
  • 来自专栏AIGC

    【LLM】基于LLama2构建智能助理帮你阅读PDF文件

    toc前言本文将演示如何利用 LLM 从 PDF 发票中提取数据。我将构建一个 FastAPI 服务器,该服务器将接受 PDF 文件并以 JSON 格式返回提取的数据。 这意味着 API 应该能够同时处理多个请求,并且应该能够水平扩展。一、PDF样例我们将以 Linode 发票为例。 预处理由于 LLM 需要文本输入,因此 PDF 文件最初必须转换为文本。 它还将使用新的集群信息更新 ~/.kube/config 文件。Paka 从 HuggingFace 中心下载 llama2-7b 模型并将其部署到集群。 小节本文演示了如何使用 LLM 从 PDF 发票中提取数据。我们构建了一个FastAPI服务器,能够接收PDF文件并以JSON格式返回信息。

    1.5K20编辑于 2024-04-27
  • 来自专栏技术杂货店

    Mybatis【2】-- Mybatis多个mapper文件以及namespace作用是什么?

    多个mapper文件以及namespace作用 要是多个mapper文件的时候怎么处理,namespace又是干什么用的呢 首先我们来看创建数据库语句: #创建数据库 CREATE DATABASE ` ,这个文件里面配置的都是整个项目与数据库相关的配置,比如运行的时候的数据库环境(连接哪一个数据库,数据库服务器的地址,用户名,密码),或者是配置外部配置文件等,最重要的是,这个文件注册了映射文件(mapper ("insertStudent",student);,就会去查找每一个mapper里面的sql配置语句,也就是类似于下面这种: <mapper namespace="mapper1"> <insert 否则会报以下错误: [5037409.jpg] 多个mapper文件,在在mybatis.xml文件里面需要注册两个文件: <! ="mapper/mapper<em>2</em>.xml"/> </mappers> 使用时候加上namespace: [20201008213833.png] 【作者简介】: 秦怀,公众号【秦怀杂货店】作者

    1.3K00发布于 2020-11-22
  • 来自专栏Python技术专栏

    Python使用PyPDF2库进行PDF文件操作的详细教程

    引言在Python中,PyPDF2是一个强大的库,用于处理PDF文件。无论是合并多个PDF文件、拆分PDF文件、提取文本或者旋转页面,PyPDF2都提供了简单而灵活的解决方案。 第二部分:合并PDF文件在这一部分,我们将学习如何使用PyPDF2库合并多个PDF文件。 ,我们需要将一个大的PDF文件拆分成多个小的文件。 )第四部分:提取PDF文本PyPDF2还允许我们从PDF文件中提取文本信息。 PyPDF2,你可以轻松地对PDF文件进行加密和解密。

    7.8K32编辑于 2024-01-25
领券