首页
学习
活动
专区
圈层
工具
发布
    • 综合排序
    • 最热优先
    • 最新优先
    时间不限
  • 来自专栏小明的数据分析笔记本

    小技巧:多个pdf文件合并及pdf文件添加页码

    扫描文件的时候每一页都是单独保存的,这个时候我想把他们合并成一个完整的pdf文件,借助Adobe Acrobat Pro DC 这个软件可以很方便的实现 直接选中需要合并的文件点击右键 选择在Acrobat image.png 给pdf文件添加页码,这里借助万彩办公大师,万彩办公大师真是一个良心软件,有很多功能,还是免费的,单单处理pdf文件的功能就有一大堆, ? 添加页码 ?

    4K20发布于 2021-07-12
  • 来自专栏算法工程师的学习日志

    使用python合并多个pdf文件

    今天需要整理一份资料,需要把多个pdf合并为一个,wps这些软件自然是有这个功能,但一般都是收费的,百度上也有很多网站,但资料上传到别人的网站,始终觉得还是不太可靠,故自己搜索了一下使用python来处理 pdf文件,故此分享这个方法 python处理pdf需要用到一个PyPDF2的库,故首先安装这个第三方库 安装这些第三方库推荐使用国内的源,比如清华、豆瓣、百度、华为等 pip install PyPDF2 target_path = r'pdf' ## pdf目录文件 pdf_lst = [f for f in os.listdir(target_path) if f.endswith('.pdf' () for pdf in pdf_lst: file_merger.append(pdf,import_bookmarks=False) # 合并pdf文件 file_merger.write (r"合并文件.pdf") 注意一下: 合并的时候,pdf_lst 是根据文件的名称来排序生成,如果对于pdf文件合成顺序有要求,建议吧文件按照期望的合成顺序编号1 2 3这样,方便一些 比如像下面这种

    3.8K10编辑于 2022-07-27
  • 来自专栏Python小屋

    使用Python合并任意多个PDF文件

    在工作中,经常会遇到合并pdf文件的需求,这时候你会发现不是一件很容易完成的任务。包括WPS、福昕阅读器在内的很多软件都有合并pdf文件的功能,但是只有交钱变成会员之后才能使用,否则只能合并3页。 有不少网站提供了在线合并pdf文件的功能,但也是必须交钱才能用。还有的显示合并成功,但就是无法下载。如果你会一点Python,就会发现这是一件很容易的事,并且不用花一分钱。 功能描述: 使用Python合并任意多个PDF文件。 详细步骤: 1、安装扩展库PyPDF2。 ? 2、编写代码。 ? 3、把代码中pdf_files的内容改成自己要合并pdf文件名,运行代码,一眨眼,合并完成。

    6K20发布于 2019-12-25
  • 来自专栏CSDNToQQCode

    表单一次性上传多个文件

    html file类型如何一次性上传多个文件 <! -- 按住CTRL挨个选择,或者鼠标框选都行 --> <input type="file" name="file" multiple="multiple"/> 选择了8个文件

    1.7K20编辑于 2022-11-29
  • 来自专栏疯狂学习GIS

    PowerShell一次性替换多个文件的名称

      本文介绍基于PowerShell语言,对文件夹中全部文件的名称加以批量替换、修改的方法。   在之前的文章再也不怕重命名班级同学文件! 基于Python批量重命名文件方法中,我们介绍了基于Python语言,批量修改大量文件的名称的方法。 本文就介绍基于PowerShell语言,批量修改文件夹中大量文件的名称的方法。   首先,来看一下我们的需求。 现有一个文件夹,如下图所示,其中我们需要修改全部文件文件名;修改的规则是,将原有每一个文件的名称中的字段CRO修改为GRA。   知道了需求,接下来我们即可开始具体操作。 此时,可以看到文件夹中的文件都已经是重命名之后的了。   

    3.2K20编辑于 2023-10-24
  • 使用ElementUI el-upload一次性上传多个文件

    在日常的前端开发中,文件上传是一个非常常见的需求,尤其是在用户需要一次性上传多个文件的场景下。 这个组件不仅能满足单文件上传的需求,还能轻松实现一次性上传多个文件。更重要的是,el-upload组件的API设计非常简洁明了,开发者可以根据自己的需求进行灵活配置。 实现多文件上传为了实现一次性上传多个文件,我们只需要在el-upload组件中设置multiple属性即可。该属性允许用户在文件选择对话框中一次性选取多个文件。 $refs.upload.submit(); } } }</script>在这个示例中,我们添加了multiple属性,使得文件选择对话框允许一次性选择多个文件。 小结ElementUI的el-upload组件为我们提供了强大的文件上传功能,不仅支持单文件上传,还可以轻松实现一次性上传多个文件

    9.2K11编辑于 2024-07-02
  • 来自专栏sktj

    python 查找多个目录下的最大Python文件 脚本

    """ Find the largest Python source file on the module import search path. Skip already-visited directories, normalize path and case so they will match properly, and include line counts in pprinted result. It's not enough to use os.environ['PYTHONPATH']: this is a subset of sys.path. """

    2.2K30编辑于 2022-05-13
  • 来自专栏完美Excel

    Excel实战技巧43: 将多个PDF文件中指定页面合并成一个PDF文件

    学习Excel技术,关注微信公众号: excelperfect 在《Python实战01:合并多个PDF文件》和《Python实战02:分别合并多个相似文件名的PDF文件》中,我们使用Python代码对 PDF文件进行操作来合并PDF文件。 其实,使用VBA也能合并PDF文件。 假设在同一文件夹中放置了要合并的PDF文件所在的文件夹、合并后的文件存放的文件夹、以及代码工作簿,其中要合并的文件存放在名为“PDF文件”的文件夹中,合并后的文件放在名为“合并的文件”的文件夹中,如下图 图3 在上图3所示的工作表中,在每个PDF文件名相邻的单元格,输入要合并的PDF文件页码,如果要合并多页,则用逗号分隔开。

    7.9K72发布于 2019-07-19
  • 来自专栏Dance with GenAI

    零代码编程:用ChatGPT来批量合并多个PDF文件

    一个文件夹里面有38个PDF文件,现在想合并成一个PDF文件。用ChatGPT可以非常简单的实现。 在ChatGPT中输入提示词如下: 这两个文件夹里面有多个PDF文件,写一段Python程序,将文件夹里面的PDF文件按照文件标题名合并成一个PDF文件,然后保存到文件夹中 F:\BaiduNetdiskDownload 文件于 {folder_path} 文件夹...") pdf_files = [f for f in os.listdir(folder_path) if f.endswith('.pdf')] pdf_files.sort () if not pdf_files: print("没有找到PDF文件。") PDF文件,合并正确:

    55410编辑于 2024-06-24
  • 专利信息自动整理实战——多个PDF文件,一张Excel表

    专利信息自动整理实战——多个PDF文件,一张Excel表手头有多个专利PDF要分析,、老板说要整理成Excel对比表,把专利名称,专利权人,摘要,摘要图片等列出来,便于快速分析该领域的专利。 打开PDF想手抄?摘要300多字,两个文件加起来就是一篇小作文。 还说要摘要附图……以前都是一个一个PDF打开,复制专利名称,专利权人,复制摘要,复制摘要图片,再打开下一个PDF,继续复制复制,打开打开,好多个PDF干下来,人都麻木了。用workbuddy,太快了。 工作流程分析工作流程:PDF→提取(专利名称,专利权人,摘要,摘要图片)→写入Excel表格前置准备把所有专利PDF放进同一个文件夹,路径不要含特殊符号、中文空格;确认专利是可复制文字版PDF(扫描件需要开启 一句话话搞定请分析附件中的专利PDF,提取首页信息到Excel。结果输出:小结workbuddy很强大,找对了工具,工作效率飞起,以后任何时候再碰到专利PDF要整理,几秒钟就出结果。

    25710编辑于 2026-06-14
  • 【拆分PDF重命名】将PDF按页拆分多个PDF文件,并用PDF里文字对文件批量重命名,python和腾讯api识别改名的完整代码和详细步骤

    一个典型的场景是,一个多页的 PDF 文件包含了多个不同主题或信息单元,而用户希望将其按页拆分成多个单独的 PDF 文件,以便于更方便地管理、存储和检索这些信息。 以下是使用 Python 和腾讯云 OCR API 实现将 PDF 按页拆分多个 PDF 文件并用 PDF 里文字对文件批量重命名 完整步骤和代码示例: 步骤 1:准备工作 安装必要的库: PyPDF2 :用于拆分 PDF 文件。 (input_pdf_path): """ 将 PDF 按页拆分为多个 PDF 文件 :param input_pdf_path: 输入的 PDF 文件路径 :return 然后在终端中运行以下命令: bash python pdf_split_and_rename.py 代码说明 split_pdf 函数:将输入的 PDF 文件按页拆分为多个单独的 PDF 文件

    4.6K10编辑于 2026-06-22
  • 来自专栏Dance with GenAI

    零代码编程:用ChatGPT提取PDF文件一页中的多个表格

    零代码编程:用ChatGPT提取PDF文件一页中的多个表格 一个PDF文件中,有好几个表格,要全部提取出来,该怎么做呢? 在ChatGPT中输入提示词: 写一段Python代码: 使用PdfPlumber库提取“F:\北交所全部上市公司的招股说明书20230710\艾能聚.pdf”第174页中的所有表格, 保存第1个表格到 save_to_excel(data, file_path): df = pd.DataFrame(data) df.to_excel(file_path, index=False) print(f"表格内容已保存到文件 (file_path) as pdf: for i, page_num in enumerate(page_num_list): page = pdf.pages[page_num - 1] tables = r"F:\北交所全部上市公司的招股说明书20230710\艾能聚.pdf" page_num_list = [174] output_folder = r"F:" extract_tables_from_pdf

    79410编辑于 2024-06-24
  • 多个pdf合并成一个文件怎么弄,按 6 步做,顺序页数都不变

    等到要一口气发给别人,或者想从头到尾完整过一遍的时候,问题就来了:多个 PDF 合并成一个文件怎么弄?这个问题问的人不少。想自己解决的人也多,但市面上的答案普遍不太省心。 还有一条路是把 PDF 页面插进文档编辑器里,再整体另存为 PDF。对付三五页的小文件还行,文件一多就撑不住:排版乱、字体丢、页码断,折腾一下午,最后还得翻出原始文件重来。 PDF 的逻辑本身很简单:把几个文件按顺序拼成一个新的完整文件。 添加文件:列表顺序就是最终顺序进入合并功能后,第一件事是把要合并的文件全部加进来。 可以一次性全选,也可以分开添加,大多数工具还支持直接拖拽文件到窗口里。 这三件事都核对完,这份合并文件才算真正能交出去。整个过程用不了两分钟,但能让提交的时候心里有底。如果核对时发现结果和预期差异很大,先检查原始 PDF 是否有加密或损坏,这类文件要提前处理。

    13810编辑于 2026-08-31
  • 来自专栏实用技术

    在python中有多个对应的库可以操作Pdf文件,其中最常用的是Pypdf2

    PDF是Portable Document Format的简称,意为“可携带文档格式”,是由Adobe Systems用于与应用程序、操作系统、硬件无关的方式进行文件交换所发展出的文件格式。 在python中有多个对应的库可以操作Pdf文件,其中最常用的是Pypdf2PyPDF是一个操作pdf的模块,现在最常用的版本是PyPDF2;需要注意的是,这个库不能操作pdf获取文字信息PyPDF2介绍 ) #初始化一个reader对象,传入文件路径infomation = pdf.getDocumentInfo() #获取文档信息number_of_pages = pdf.getNumPages() input_path) #初始化一个reader对象,传入文件路径#pdf = pdf.decrypt('password') #对加密的文件机密infomation = pdf.getDocumentInfo ','wb'))3、重要的概念PageObject:在PdfFileReader加载pdf文件后,获取的每一页都会被转换为PageObject对象,对于Pdf的操作,实际就是在操作PageObject对象

    1.9K10编辑于 2022-07-04
  • 来自专栏创作特训营

    WorkBuddy 实战:50 份简历 30 分钟筛完,还能自动出评估报告

    HR同事把简历全部下载到一个文件夹里,然后转给我:"你看看哪些值得面试,周五前给我名单。"53份简历,每份2-4页PDF。 53份PDF逐份喂进去,一份3-5分钟,加上切换窗口的时间,光喂简历就要大半天。而且每次对话的评分标准不统一——第一份可能看技术栈权重高,到第三十份标准已经漂移了。 (图片格式),首次解析时文本提取为空,直接跳过根因招聘专家默认用文本提取模式解析PDF,扫描版PDF无文本层解决追问中声明"3份扫描版PDF请用OCR方式重新解析"效果OCR重新解析后3份简历补入排名表教训批量处理异构文件时 素材在桌面{文件夹名}/文件夹下,包含:-resumes/:简历PDF-jd/:岗位说明书-salary-range/:薪酬范围表-culture/:公司价值观文档验收标准:1.评分维度:技术栈匹配度( 53份简历一次性处理,彻底解决了人工筛选"看到后面忘了前面"的问题——AI的一致性在这里确实是碾压级优势。

    98753编辑于 2026-09-10
  • 来自专栏AI资讯

    零门槛上手:获取OpenAI API Key用 GPT-5 打造你的私人 PDF 分析机器人( 附!Python代码)

    关键主题与洞察 识别并阐述文档中反复出现的 3-5 个核心主题。对于每个主题,提供简要的解释和相关的证据或例子。 加载和检查配置 --- # load_dotenv() 会查找当前目录下的 .env 文件并加载其内容 load_dotenv() # 使用 os.getenv() 安全地获取配置 放入 PDF:将你想要分析的 PDF 文件(例如 年度财报.pdf)放到 PDF-Analyzer 文件夹中。 我们的脚本核心是“分而治之”(Map-Reduce)策略,以绕过 AI 模型一次性处理文本的长度限制。 分 (Map):脚本首先使用 pymupdf 精准地提取 PDF 的所有文本和表格,然后用 tiktoken 将长文本切成多个带有重叠部分的小块。

    1.2K10编辑于 2025-08-27
  • 工厂质检员用AI查工艺规范:从翻手册到秒回答的转变

    【写在前面】去过工厂的人都知道,质检员工位旁边通常有一摞厚厚的文件夹:工艺规范、检验标准、异常处理流程……新品上线要查参数、客户投诉要查标准、设备异常要查处置方案。每次查一个数据,平均翻3-5分钟。 【问题拆解:为什么“翻手册”这么慢】传统工艺文档管理有三个痛点:痛点一:文档分散工艺规范存在不同文件夹里,有的PDF、有的Word、有的纸质版,每次要确认“哪一版是最新的”。 核心流程如下:第一步:文档准备收集所有工艺规范PDF,统一存放在一个文件夹按机型+工序命名文件,便于后续维护第二步:知识库构建(RAG)将PDF文档切分成段落(按“章节+表格”为切分单位)对每个段落生成向量索引 系统将问题转为向量,在知识库中检索最相关的3-5个段落将检索到的段落 + 原始问题,一起提交给大模型生成答案答案末尾自动附上来源(如“摘自《SMT工艺规范_v3.2》第12页”)架构示意(纯文本):第一层 用AI解决这类“信息查找”类问题,技术门槛其实不高,ROI却往往很可观——每天帮每个质检员省下30分钟,一个20人的团队一年就是几千个小时。

    29410编辑于 2026-04-28
  • Claude Code创始人内部分享:10个实战技巧

    并行处理:同时启动多个工作区 同时启动3-5个git工作树,每个运行独立的Claude会话。团队认为这是最大的生产力提升点。 虽然Boris本人更倾向于使用多个git检出,但大多数团队成员更偏爱工作树方式。 2. 计划模式:先规划再执行 对于复杂任务,始终从计划模式开始。 将精力集中在规划阶段,让Claude能够一次性完成实现。有人会先让一个Claude编写计划,然后启动第二个Claude以资深工程师的身份进行审查。 3. CLAUDE.md文件:让AI自我改进 持续投资CLAUDE.md文件。每次纠正错误后,以"更新你的CLAUDE.md,避免再犯相同错误"结束对话。Claude在为自己编写规则方面表现出色。 比如构建一个/techdebt斜杠命令,在每次会话结束时运行,查找并消除重复代码。 5.

    28010编辑于 2026-06-23
  • 来自专栏我的小工具

    用WorkBuddy实现Ollama OCR:本地化智能文字识别系统开发复盘

    在日常工作中,我们经常遇到以下场景:-文档数字化:大量纸质文件需要电子化,但商业OCRAPI按次收费,成本居高不下-隐私敏感:金融、医疗、法律等行业,文档不能上传到云端-批量处理:成百上千份PDF/图片需要识别 支持:用PyMuPDF将PDF逐页转为图片,再调用OCR2.批量上传:支持同时上传多个文件3.本地路径模式:直接输入文件或目录路径,避免大文件上传超时"------------阶段3:PDF智能识别(矢量 ---打印文档qwen2-vl:7b98%95%5-8秒手写笔记qwen2-vl:7b85%70%8-10秒扫描件PDFllava:7b92%88%10-15秒发票deepseek-ocr96%98%3- -输入:日语竖排PDF-模式:__JAPANESE__(自动转换为横排文字)-输出:Markdown文件(保留章节结构)七、WorkBuddy使用心得与建议7.1如何高效使用WorkBuddy? 2.分步骤实现,不要一次性堆砌需求-第一步:实现基础OCR接口-第二步:增加PDF支持-第三步:增加导出功能-第四步:优化UI界面3.让WorkBuddy解释代码"这段代码是什么意思?

    1.3K10编辑于 2026-05-11
  • # 从零到一:用 WorkBuddy 开发物流唛头批量制作工具,597箱标签一键生成

    、箱号、MadeinChina四区域布局一键打印或保存PDF用时不到3分钟,从描述需求到拿到可打印的HTML文件,手工排版至少1小时的活儿,AI3分钟搞定。 但这版只是"一次性"工具,换个客户就要重新做。所以我决定升级。 四、Step2:升级为通用唛头制作工具我告诉WorkBuddy:帮我直接做个网页版唛头制作界面,一般默认一页是一个唛头,也允许多个唛头一页WorkBuddy生成了一个带左侧配置面板+右侧预览的交互式网页工具 v7:打印和PDF分开+校验逻辑打印/保存PDF设计成两个按钮;增加校验逻辑,总箱数=型号区间箱数总和打印和PDF拆成独立按钮;新增校验(总数匹配、区间重叠、漏箱检测),输入时静默刷新,点击按钮才弹错误提示 2.一句话迭代每轮改进只需要一句话告诉AI要改什么,3-5分钟完成。改完预览效果,不满意再调。6轮迭代累计30分钟,传统开发至少要几天。

    37810编辑于 2026-07-16
领券