首页
学习
活动
专区
圈层
工具
发布
    • 综合排序
    • 最热优先
    • 最新优先
    时间不限
  • 来自专栏小明的数据分析笔记本

    小技巧:多个pdf文件合并及pdf文件添加页码

    扫描文件的时候每一页都是单独保存的,这个时候我想把他们合并成一个完整的pdf文件,借助Adobe Acrobat Pro DC 这个软件可以很方便的实现 直接选中需要合并的文件点击右键 选择在Acrobat image.png 给pdf文件添加页码,这里借助万彩办公大师,万彩办公大师真是一个良心软件,有很多功能,还是免费的,单单处理pdf文件的功能就有一大堆, ? 添加页码 ? 欢迎大家关注我的公众号 小明的数据分析笔记本 小明的数据分析笔记本 公众号 主要分享:1、R语言和python做数据分析和数据可视化的简单小例子;2、园艺植物相关转录组学、基因组学、群体遗传学文献阅读笔记;3

    4K20发布于 2021-07-12
  • 来自专栏算法工程师的学习日志

    使用python合并多个pdf文件

    今天需要整理一份资料,需要把多个pdf合并为一个,wps这些软件自然是有这个功能,但一般都是收费的,百度上也有很多网站,但资料上传到别人的网站,始终觉得还是不太可靠,故自己搜索了一下使用python来处理 pdf文件,故此分享这个方法 python处理pdf需要用到一个PyPDF2的库,故首先安装这个第三方库 安装这些第三方库推荐使用国内的源,比如清华、豆瓣、百度、华为等 pip install PyPDF2 target_path = r'pdf' ## pdf目录文件 pdf_lst = [f for f in os.listdir(target_path) if f.endswith('.pdf' () for pdf in pdf_lst: file_merger.append(pdf,import_bookmarks=False) # 合并pdf文件 file_merger.write (r"合并文件.pdf") 注意一下: 合并的时候,pdf_lst 是根据文件的名称来排序生成,如果对于pdf文件合成顺序有要求,建议吧文件按照期望的合成顺序编号1 2 3这样,方便一些 比如像下面这种

    3.8K10编辑于 2022-07-27
  • 来自专栏Python小屋

    使用Python合并任意多个PDF文件

    在工作中,经常会遇到合并pdf文件的需求,这时候你会发现不是一件很容易完成的任务。包括WPS、福昕阅读器在内的很多软件都有合并pdf文件的功能,但是只有交钱变成会员之后才能使用,否则只能合并3页。 有不少网站提供了在线合并pdf文件的功能,但也是必须交钱才能用。还有的显示合并成功,但就是无法下载。如果你会一点Python,就会发现这是一件很容易的事,并且不用花一分钱。 功能描述: 使用Python合并任意多个PDF文件。 详细步骤: 1、安装扩展库PyPDF2。 ? 2、编写代码。 ? 3、把代码中pdf_files的内容改成自己要合并pdf文件名,运行代码,一眨眼,合并完成。

    6K20发布于 2019-12-25
  • 来自专栏CSDNToQQCode

    表单一次性上传多个文件

    html file类型如何一次性上传多个文件 <! -- 按住CTRL挨个选择,或者鼠标框选都行 --> <input type="file" name="file" multiple="multiple"/> 选择了8个文件

    1.7K20编辑于 2022-11-29
  • 来自专栏疯狂学习GIS

    PowerShell一次性替换多个文件的名称

      本文介绍基于PowerShell语言,对文件夹中全部文件的名称加以批量替换、修改的方法。   在之前的文章再也不怕重命名班级同学文件! 基于Python批量重命名文件方法中,我们介绍了基于Python语言,批量修改大量文件的名称的方法。 本文就介绍基于PowerShell语言,批量修改文件夹中大量文件的名称的方法。   首先,来看一下我们的需求。 现有一个文件夹,如下图所示,其中我们需要修改全部文件文件名;修改的规则是,将原有每一个文件的名称中的字段CRO修改为GRA。   知道了需求,接下来我们即可开始具体操作。 此时,可以看到文件夹中的文件都已经是重命名之后的了。   

    3.2K20编辑于 2023-10-24
  • 使用ElementUI el-upload一次性上传多个文件

    在日常的前端开发中,文件上传是一个非常常见的需求,尤其是在用户需要一次性上传多个文件的场景下。 这个组件不仅能满足单文件上传的需求,还能轻松实现一次性上传多个文件。更重要的是,el-upload组件的API设计非常简洁明了,开发者可以根据自己的需求进行灵活配置。 实现多文件上传为了实现一次性上传多个文件,我们只需要在el-upload组件中设置multiple属性即可。该属性允许用户在文件选择对话框中一次性选取多个文件。 $refs.upload.submit(); } } }</script>在这个示例中,我们添加了multiple属性,使得文件选择对话框允许一次性选择多个文件。 小结ElementUI的el-upload组件为我们提供了强大的文件上传功能,不仅支持单文件上传,还可以轻松实现一次性上传多个文件

    9.2K11编辑于 2024-07-02
  • 来自专栏python3

    python3读取pdf文件

    一.安装pdfminer3k模块 二.读取pdf文件 import sys import importlib importlib.reload(sys) from pdfminer.pdfparser from pdfminer.pdfinterp import PDFTextExtractionNotAllowed def readPDF(path, toPath): # 以二进制形式打开pdf 文件 with open(path, "rb") as f: # 创建一个pdf文档分析器 parser = PDFParser(f) # 创建pdf # print(str) f.write(str+"\n") path = r"G:\program\PycharmProjects\day06\3. 读取pdf文件\文档.pdf" toPath = r"G:\program\PycharmProjects\day06\3.读取pdf文件\a.txt" readPDF(path, toPath)

    2.8K10发布于 2020-01-10
  • 来自专栏DATABASE

    3.查找定位文件命令

    3.ls命令 ls命令用于显示目录中的文件信息,英文全称为“list”,语法格式为“ls [参数] [文件名称]”。 所处的工作目录不同,当前工作目录下能看到的文件肯定也不同。 ,语法格式为“find [查找范围] 寻找条件”。 f2匹配比文件f1新但比f2旧的文件-type b/d/c/p/l/f匹配文件类型(后面的字幕字母依次表示块设备、目录、字符设备、管道、链接文件、文本文件)-size匹配文件的大小(+50KB为查找超过 50KB的文件,而-50KB为查找小于50KB的文件)-prune忽略某个目录-exec …… {}\;后面可跟用于进一步处理搜索结果的命令(下文会有演示) 这里需要重点讲解-exec参数的重要作用。 在使用locate命令时,先使用updatedb命令生成一个索引库文件,这个库文件的名字是/var/lib/mlocate/mlocate.db,后续在使用locate命令搜索文件时就是在该库中进行查找操作

    1.1K20编辑于 2022-05-07
  • 来自专栏sktj

    python 查找多个目录下的最大Python文件 脚本

    allsizes.sort() pprint.pprint(allsizes[:3]) pprint.pprint(allsizes[-3:]) print('By lines...') allsizes.sort(key=lambda x: x[1]) pprint.pprint(allsizes[:3]) pprint.pprint(allsizes[-3:])

    2.2K30编辑于 2022-05-13
  • 来自专栏完美Excel

    Excel实战技巧43: 将多个PDF文件中指定页面合并成一个PDF文件

    学习Excel技术,关注微信公众号: excelperfect 在《Python实战01:合并多个PDF文件》和《Python实战02:分别合并多个相似文件名的PDF文件》中,我们使用Python代码对 PDF文件进行操作来合并PDF文件。 假设在同一文件夹中放置了要合并的PDF文件所在的文件夹、合并后的文件存放的文件夹、以及代码工作簿,其中要合并的文件存放在名为“PDF文件”的文件夹中,合并后的文件放在名为“合并的文件”的文件夹中,如下图 图3 在上图3所示的工作表中,在每个PDF文件名相邻的单元格,输入要合并的PDF文件页码,如果要合并多页,则用逗号分隔开。 例如,数字2表明要合并文件“完美Excel.pdf”的第2页,数字2,6表明要合并文件“汇总.pdf”的第3页和第6页,如下图4所示。 ?

    7.9K72发布于 2019-07-19
  • 来自专栏python3

    Unity3D读取PDF文件内容

    最近在研究Unity3D中读取PDF的内容,预想了三种方案,一是用Java来实现,二是调用C#的iTextSharp库或者PDFBox库来实现,三是下载PDF Renderer插件(土豪可以买这个插件, 再写代码之前呢,得在Assets下的Plugins文件夹中导入itextsharp.dll、Spire.Pdf.dll、Spire.License.dll、System.Drawing.dll库,才能好使 直接上传代码: //读取PDF文字内容 private void ReadPDF_Click() { string path = Application.streamingAssetsPath strategy = new iTextSharp.text.pdf.parser.SimpleTextExtractionStrategy(); text += iTextSharp.text.pdf.parser.PdfTextExtractor.GetTextFromPage System.AppDomain.CurrentDomain.SetupInformation.ApplicationBase + "\\mylog.log"); wlog.WriteLine("出错文件

    2.3K30发布于 2020-01-07
  • 来自专栏Dance with GenAI

    零代码编程:用ChatGPT来批量合并多个PDF文件

    一个文件夹里面有38个PDF文件,现在想合并成一个PDF文件。用ChatGPT可以非常简单的实现。 在ChatGPT中输入提示词如下: 这两个文件夹里面有多个PDF文件,写一段Python程序,将文件夹里面的PDF文件按照文件标题名合并成一个PDF文件,然后保存到文件夹中 F:\BaiduNetdiskDownload 文件于 {folder_path} 文件夹...") pdf_files = [f for f in os.listdir(folder_path) if f.endswith('.pdf')] pdf_files.sort () if not pdf_files: print("没有找到PDF文件。") PDF文件,合并正确:

    55410编辑于 2024-06-24
  • 专利信息自动整理实战——多个PDF文件,一张Excel表

    专利信息自动整理实战——多个PDF文件,一张Excel表手头有多个专利PDF要分析,、老板说要整理成Excel对比表,把专利名称,专利权人,摘要,摘要图片等列出来,便于快速分析该领域的专利。 打开PDF想手抄?摘要300多字,两个文件加起来就是一篇小作文。 还说要摘要附图……以前都是一个一个PDF打开,复制专利名称,专利权人,复制摘要,复制摘要图片,再打开下一个PDF,继续复制复制,打开打开,好多个PDF干下来,人都麻木了。用workbuddy,太快了。 工作流程分析工作流程:PDF→提取(专利名称,专利权人,摘要,摘要图片)→写入Excel表格前置准备把所有专利PDF放进同一个文件夹,路径不要含特殊符号、中文空格;确认专利是可复制文字版PDF(扫描件需要开启 一句话话搞定请分析附件中的专利PDF,提取首页信息到Excel。结果输出:小结workbuddy很强大,找对了工具,工作效率飞起,以后任何时候再碰到专利PDF要整理,几秒钟就出结果。

    25710编辑于 2026-06-14
  • 来自专栏有趣的django

    3.shell编程-文件查找之find命令

    -user      查找当前目录为root用户的文件 find ./ -user root 3.3. -size 文件大小 -n    小与n的文件 +n   大于n的文件  查找/etc目录下小与100k的文件 find /etc -size -100k 查找/etc目录下大于1M的文件 find / -mtime 修改时间 -n    n天以内修改的文件 +n   n天以外修改的文件 n     正好n天修改的文件  查找/etc目录下5天之内修改并且以conf结尾的文件 find /etc -mtime -5 -name '*.conf' 查找/etc目录下10天之前修改并且属主为root的文件 find /etc -mtime +10 -user root 3.6. -mindepth  表示从n级子目录开始搜索 find /etc -mindepth 3 -type -f -madepth n 表示最多搜索到n-1级子目录 3.8.操作-exec 对搜索的文件常用操作

    1.2K50发布于 2019-07-01
  • 【拆分PDF重命名】将PDF按页拆分多个PDF文件,并用PDF里文字对文件批量重命名,python和腾讯api识别改名的完整代码和详细步骤

    一个典型的场景是,一个多页的 PDF 文件包含了多个不同主题或信息单元,而用户希望将其按页拆分成多个单独的 PDF 文件,以便于更方便地管理、存储和检索这些信息。 以下是使用 Python 和腾讯云 OCR API 实现将 PDF 按页拆分多个 PDF 文件并用 PDF 里文字对文件批量重命名 完整步骤和代码示例: 步骤 1:准备工作 安装必要的库: PyPDF2 (input_pdf_path): """ 将 PDF 按页拆分为多个 PDF 文件 :param input_pdf_path: 输入的 PDF 文件路径 :return rename_pdfs(split_pdfs) 步骤 3:运行代码 将上述代码保存为一个 Python 文件(例如 pdf_split_and_rename.py),并将 your_secret_id 然后在终端中运行以下命令: bash python pdf_split_and_rename.py 代码说明 split_pdf 函数:将输入的 PDF 文件按页拆分为多个单独的 PDF 文件

    4.6K10编辑于 2026-06-22
  • 来自专栏马拉松程序员的专栏

    3行代码将PDF中表格转成Excel文件

    今天有空我来写一个转换脚本,一共3行代码搞定。 需求: 将PDF文件中的表格转成Excel文件 背景知识: 本次我们使用的转换包是Camelot 。 翻译一下就是Camelot是一个Python库,任何人都可以轻松地从PDF文件中提取表格! 下载测试文件: 一般情况下,演示PDF转换效果,会找一个比较简单的pdf文件,做测试,看下能否跑通。但是我的电脑里一时间竟然没有找到一个合适的pdf文件(包含表格的)。 内容比较多,我这里截取第3页的内容。 文件:宁德时代:2021年第一季度报告全文.PDF 完成目标: 读取宁德时代的Q1财报PDF中的主要会计数据和财务指标转成excel表格。 目标是不是很清晰。 编写代码: import camelot tables = camelot.read_pdf('宁德时代:2021年第一季度报告全文.PDF', pages="3") tables[0].to_excel

    4.1K20编辑于 2022-04-26
  • 来自专栏Y大宽

    linux全套教程【黑马】:3 文件查找和内容检索

    文件属性查找 1按文件查找 find + 查找的目录 + -name +“文件的名字” $ find /mnt/f/kelly/bioTree/linux20/ -name me.txt /mnt /f/kelly/bioTree/linux20/me.txt 通配符 *统配多个字符 ? 通配一个字符 2 按文件大小查找 find +查找目录 + -size + 大小 $ find /mnt/f/kelly/bioTree/ -size +10k#大于10k(k小写) $ find /mnt /biosoft/bowtie2/bowtie2-2.2.9-linux-x86_64.zip 3文件类型 文件类型 find + 文件目录 + -type + d/f/b/c/s/p/l $ find -type f 按文件内容查找 想知道哪个文件里有什么样的字符串,需要找到包含字符串的文件 也就是按文件内容查找 grep grep -r "要查找的内容” +查找的路径 注意和find

    2.1K20发布于 2019-05-21
  • 来自专栏Unity3d程序开发

    Unity3d+c#:Dictionary多个key查找一个value,重载Equals

    : DataKey2 { public int mKey3; public DataKey3(int key1, int key2, int key3) : base(key1, key2) { mKey3 = key3; } public override bool Equals (object obj) { if (obj == null) return false; DataKey3 key = obj as DataKey3 ; if (key == null) return false; return this.mKey3 == key.mKey3 && this.mKey2 public DataKey4(int key1, int key2, int key3, int key4) : base(key1, key2, key3)

    56920编辑于 2023-08-24
  • 来自专栏Python小屋

    Python使用pdfminer3k提取PDF文件中的文本

    任务描述: 编写Python程序,提取PDF文件中的文本内容,生成与原PDF文件同名的文本文件。 准备工作: 安装扩展库pdfminer3k。 参考代码:

    5.6K10编辑于 2022-03-07
  • 3种简单方法将 TXT 文件转换为 PDF 格式

    步骤 3: 选择 “Microsoft Print to PDF”,然后点击 “Print(打印)”。接下来,你可以浏览文件夹并选择希望保存转换后 PDF 文件的位置。 方法 2:在线将 TXT 文件转换为 PDF如果你无法使用桌面软件,在线文件格式转换工具是一个便捷的选择。这类工具可以直接在浏览器中运行,无需安装软件,即可将 TXT 文件转换为 PDF。 步骤 2: 根据页面提示,点击上传区域或直接拖拽 TXT 文件进行上传,然后等待系统完成文件分析。步骤 3文件自动分析完成后,系统会立即开始转换。只需耐心等待片刻,整个转换过程不会花费太长时间。 方法 3:通过代码实现 TXT 转 PDF(C# 示例)如果你是开发者,或者需要批量自动处理多个 TXT 文件,那么使用代码实现转换可以节省大量时间和操作成本。 文件 pdf.SaveToFile("TextToPdf.pdf", FileFormat.PDF); } }}总结将 TXT 文件转换为 PDF 可以提升文件的可读性

    47100编辑于 2026-07-20
领券