ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

douyin-downloader 使用指南:从一条链接到整站主页的无水印批量下载

douyin-downloader 使用指南:从一条链接到整站主页的无水印批量下载 douyin-downloader 使用指南从一条链接到整站主页的无水印批量下载【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader如果你也试过录屏保存抖音视频却带着挥不掉的水印或者把链接贴到解析网站却拿回被二次压缩的模糊文件那么这个开源项目 douyin-downloader 值得试试。它直接获取无水印的原始视频文件并自动按码率挑出最高清晰度保存既能下载单条视频、图文和合集也能把一位作者主页的作品整批拉下来支持增量更新和历史去重。 它能做什么能力总览支持对象广单个视频、图文note、合集mix、原声音乐music以及作者主页、自己账号的收藏夹输入方式简单v.douyin.com短链、/video/完整链接、主页链接都能识别不用手动找原始地址输出有条理视频、封面、音频、元数据 JSON 一起保存默认按作者和类型归档过程可控实时进度条、失败自动退避重试、下载后校验文件大小半截文件会自动清掉重下不重复劳动SQLite 数据库加本地文件双重去重重跑任务不会重复下载可选扩展直播录制、评论采集、热搜与关键词搜索、完成通知、REST API、Docker 部署 安装依赖并准备登录凭证环境要求不高Python 3.8 及以上Windows、macOS、Linux 都可以。仓库克隆下来后核心程序位于douyin-downloader子目录仓库根目录的脚本是早期版本进入它完成安装和配置复制git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader/douyin-downloader pip install -r requirements.txt cp config.example.yml config.yml抖音的内容需要登录状态才能访问所以还需要一份 Cookie可以理解成已登录的凭证。项目内置了自动获取脚本先装好 Playwright 浏览器组件再运行它pip install playwright python -m playwright install chromium python -m tools.cookie_fetcher --config config.yml在打开的浏览器里扫码登录回到终端按回车Cookie 就会自动写入config.yml。如果不想装 Playwright也可以从浏览器里复制 Cookie 字符串手动填进配置。▶️ 完成一次无水印下载最小配置只需要两项要下载的链接和保存目录。link: - https://v.douyin.com/你的短链/ path: ./Downloaded/保存后执行一条命令即可python run.py -c config.yml运行过程中你会看到清晰的进度展示某条请求失败时按 1 秒、2 秒、5 秒的间隔自动重试下载结束后还会比对文件长度发现不完整就删除重下避免留下半截文件。视频源会自动优先选无水印的那一份再按码率挑最清晰的版本这些都不需要你干预。 批量拉取作者主页支持增量更新想收藏一位博主的全部内容把链接换成主页地址用mode声明要哪几类内容即可link: - https://www.douyin.com/user/作者主页链接 mode: - post - like number: post: 0 like: 0 increase: post: true几个关键字段的含义modepost发布作品、like点赞内容、mix合集、music原声音乐collect/collectmix用于自己账号的收藏夹且需单独使用number填 0 表示不限制数量increase打开后再次运行只拉新增作品适合长期追更start_time/end_time按日期区间过滤比如只整理某博主去年的内容同一个作品即使在多个分类里出现也只会被下载一次跨模式自动去重。️ 文件与下载历史如何管理默认开启folderstyle每个作品单独一个文件夹挂在作者名下结构大致是Downloaded/作者名/post/2024-02-07_作品标题_作品ID/无水印视频、封面、原声音乐、data.json元数据、作者头像like/、mix/、music/、live/直播录制时生成命名规则也可以改配置里的filename_template和folder_template支持{date}、{title}、{id}、{author}等变量改成你习惯的格式即可。所有下载记录存进本地 SQLite 数据库默认dy_downloader.db想翻查历史时用一条查询看最近 20 条sqlite3 dy_downloader.db SELECT aweme_id, title, author_name FROM aweme ORDER BY download_time DESC LIMIT 20;桌面版客户端还提供作品档案界面可按作者、关键词、时间筛选方便确认某位博主我存过多少条、最新一条是什么。 进阶可选功能基础流程跑通后下面这些能力可以按需开启直播录制链接指向live.douyin.com/房间号即可按选择的清晰度录制主播下播或断网时已录部分会完整保留文件存在作者名/live/下并附房间信息快照评论采集打开comments.enabled后每个作品旁生成一份*_comments.json含评论内容与点赞数适合做内容分析热搜与关键词搜索python run.py --hot-board 30 -p ./Downloaded或python run.py --search 关键词结果以 JSONL 格式落盘完成通知配置 Bark、Telegram 或 Webhook长任务跑完自动推送到手机REST API 服务python run.py --serve --serve-port 8000启动后可通过接口提交下载任务、查询任务状态便于接入自己的自动化流程Docker 部署项目自带 Dockerfile适合长期挂机运行视频转写可选调用 OpenAI 转写 API把视频语音生成 txt/json 文稿仅对视频作品生效❓ 几个常见问题问题处理办法主页明明有几百条只拉到 20 条这是翻页风控的正常现象。把browser_fallback的enabled设为true、headless设为falseAPI 受限时会自动切到浏览器翻页弹窗出现后手动完成一次验证即可Cookie 失效、下载报错重新运行 Cookie 获取命令扫码后自动刷新配置想重新下载某个作品工具做了双重去重先删掉本地对应文件夹再用 sqlite3 删掉数据库里同 ID 的记录两处都清掉才会重新拉取没有生成转写文件转写只对视频作品生效检查transcript.enabled是否为true、API 密钥是否有效⚖️ 适用边界与使用提醒这个项目适合个人学习、技术研究和整理自己的收藏内容单条收藏、追更喜欢的创作者、按时间段整理素材都是它擅长的场景。批量能力和接口调用量较大不建议长时间高频运行遇到风控时优先走浏览器兜底而不是加压重试。项目本身免费开源但请把它用在合法合规的范围内尊重原创作者的版权不用于侵犯隐私或任何违规用途平台规则或接口策略变化导致功能失效属于正常的技术风险。现在就可以复制上面的安装命令先用一条你最想保存的短链跑通第一个下载再慢慢尝试整站主页和进阶玩法。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表