ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

如何从视频提取PPT成PDF?extract-video-ppt 安装、跑通与调参实战

如何从视频提取PPT成PDF?extract-video-ppt 安装、跑通与调参实战 如何从视频提取PPT成PDFextract-video-ppt 安装、跑通与调参实战【免费下载链接】extract-video-pptextract the ppt in the video项目地址: https://gitcode.com/gh_mirrors/ex/extract-video-ppt期末前整理一门 90 分钟的录播课真正有用的只有 30 页幻灯片你却得逐帧快进、暂停、截图、命名忙到深夜眼睛发花。这类视频里翻 PPT的活儿其实可以整包交出去extract-video-ppt 会自动扫描视频画面把每一页不重复的幻灯片截下来最后拼成一份能直接打印的 PDF你只负责敲一条命令。上面这张就是它实际抽出来的某一帧文件名里带着出现时间和相似度数值方便你回头定位。装好并跑通从 pip 到第一条 evp 命令环境要求很简单一台装好 Python 3 的电脑一条命令装完pip install extract-video-ppt装完系统会多出一个evp命令先让它报个平安evp --help✅ 看到参数说明就可以拿项目自带的素材开刀。仓库里的demo/目录备齐了演示视频、样例 PPTX 和成品 PDF照着官方示例跑evp --similarity 0.6 --pdfname hello.pdf --start_frame 00:00:09 --end_frame 00:00:30 ./demo ./demo/demo.mp4这条命令里./demo/demo.mp4是输入视频./demo是结果输出目录--pdfname指定 PDF 名字其余参数下面细讲。其实最简形态也成立默认值直接跑evp ./output ./demo/demo.mp4执行时屏幕会不断刷新处理百分比结束后去./output里拿 PDF 就行。更习惯源码方式的话git clone https://gitcode.com/gh_mirrors/ex/extract-video-ppt cd extract-video-ppt python setup.py install它怎么知道这一页换了原理与模块分工你可以把每帧画面想象成一杯颜色配方工具会把画面拆成 256 档色调的分布图再和最近一次被保存的那帧逐档比对。两杯配方几乎一样说明只是讲师挥了挥手、光标漂了一下直接扔掉配方整体变了才认定换页并截图。大白话它不关心动没动只关心内容变没变。具体节奏是每秒抽一帧做一次比对命中的帧存成 JPG文件名自带时间点和相似度比如frame00.00.09-0.5.jpg最后统一合成 PDF而且每页顶部会印上对应截图的文件名查页很方便。这套逻辑都放在video2ppt/目录下分工很清晰video2ppt/video2ppt.py负责读帧、调度、清理现场video2ppt/compare.py负责相似度计算video2ppt/images2pdf.py负责把截图拼成 PDF。整条流水线就是抽帧 → 比对筛选 → 拼 PDF三步。四个参数速查参数作用默认值何时调整--similarity相似度阈值低于它才保存这一帧0.6抽出的页数偏多或偏少时--pdfname输出 PDF 的文件名output.pdf想给每个视频定制 PDF 名时--start_frame开始处理的时间点00:00:00只要视频中间某一段时--end_frame结束处理的时间点INFINITY视频很长、只关心前段时四个参数都不加也能跑但想控制质量--similarity是绕不开的主角。相似度阈值我常用的三档经验值先建立方向感阈值调高 更敏感画面稍有变化就存页数全但废图多阈值调低 更苛刻变化明显才存页数精但可能漏页。我的三档经验动画、转场密集的演示片0.4~0.5。一页带飞入动画的幻灯片帧间差异本来就小阈值太高整页会被并掉。正常语速的讲课录像保持默认 0.6 就好换页能抓到激光笔和鼠标晃动基本被过滤。几乎静止的长录屏0.7~0.8只留真正的大改动免得 PDF 里塞几十页几乎一样的画面。我的做法是先默认值跑一遍页数明显偏多就往上抬 0.1明显漏页就往下压 0.1两轮基本能定下来。时间裁剪与报错速查视频两小时、干货只有中间二十分钟圈个时间段最省事evp --start_frame 00:10:00 --end_frame 00:25:00 ./output ./course.mp4时间写法是标准的时:分:秒。这里顺手把源码里会打印的报错整理成一张对照表提示含义start end can not work起始时间晚于或等于结束时间两个参数写反了Please check if the video url is correct视频路径不对或文件打不开检查路径与格式video duration is not support--start_frame超过了视频实际时长write file failed !输出目录没有写权限换个自己可控的目录另外处理过程中会在当前目录建一个./.extract-video-ppt-tmp-data临时文件夹存放中间截图正常跑完会自动清掉万一中途强退残留了手动删掉也不影响下次运行。批量处理与超长视频的进阶思路一个文件夹里的视频可以套个循环全跑完for v in *.mp4; do mkdir -p out_${v%.mp4} evp --similarity 0.6 --pdfname ${v%.mp4}.pdf out_${v%.mp4} $v done单集特别长的片子建议分段按小时切成几段分别提取得到多份 PDF 后再用任意合并工具拼起来。好处是中途断了只丢当前这一段重跑成本低而且临时目录每次运行完都会清理反复重跑也不会互相污染。现在就去跑你的第一段视频 省下来的不只是截图的功夫而是把整理从手工活变成一次命令的事下次课前复习、归档会议录屏、备份自己的演讲录像都会快很多。第一步很小打开终端执行pip install extract-video-ppt挑一段你最近看过的带 PPT 的录播把最简命令evp ./output 你的视频.mp4敲下去。页数不合心意时别急着怀疑工具坏了回到--similarity上调两下你的最佳阈值很快就有手感。【免费下载链接】extract-video-pptextract the ppt in the video项目地址: https://gitcode.com/gh_mirrors/ex/extract-video-ppt创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表