ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

6种下载模式的抖音批量下载器:从Cookie到落盘的全流程

6种下载模式的抖音批量下载器:从Cookie到落盘的全流程 6种下载模式的抖音批量下载器从Cookie到落盘的全流程【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloaderDouyin Downloader 是一个命令行驱动的抖音下载器把视频、图文笔记、合集、音乐和收藏夹交给它它负责无水印取源、SQLite 去重、失败重试并在翻页被风控拦截时用浏览器兜底。默认 5 线程并发、限速 2 req/s下载完成后按作者名/模式/日期_标题_作品ID落盘并额外生成一份download_manifest.jsonl清单记录每个作品的标签和文件位置。项目要求 Python 3.8配置就是一个 YAML 文件想要图形界面可以留意基于同一套后端开发的桌面版 Douzy。️ 下载能力总览它接受三类输入单条内容链接视频、图文、合集、音乐、作者主页链接、登录态收藏夹链接。围绕输入工作模式决定了拉取什么模式拉取内容配合的链接post作者主页作品/user/{sec_uid}like作者点赞的作品/user/{sec_uid}mix作者的合集/user/{sec_uid}或单合集链接music音乐原声/music/{music_id}或主页链接collect/collectmix登录账号的收藏作品 / 收藏合集/user/self?showTabfavorite_collection且必须单独使用输出维度上每个作品默认只落视频本体封面、音乐、作者头像、JSON 元数据可按开关追加工程维度上则内置并发控制、指数退避重试1s/2s/5s、速率限制、Content-Length 完整性校验以及时间过滤、评论采集、语音转写和任务结束通知等扩展项。⚙️ 从克隆仓库到跑通第一个任务克隆仓库并安装基础依赖。git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt安装浏览器兜底所需的 Playwright 内核。翻页受限时要靠它接管。pip install playwright python -m playwright install chromium自动抓取 Cookie。命令会拉起浏览器登录抖音后回终端按回车Cookie 会写回config.yml。python -m tools.cookie_fetcher --config config.yml准备最小配置并启动。从仓库里的config.example.yml抄一份按需修改link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx # 要下载的作者主页 path: ./Downloaded/ # 下载根目录 mode: [post] # post主页作品还可叠加 like / mix / music start_time: 2025-01-01 # 可选只拉该日期之后发布的作品 number: post: 50 # 0 表示不限量 thread: 5 # 并发线程数 database: true # SQLite 去重与历史记录 browser_fallback: enabled: true # 翻页被风控时启动浏览器兜底 headless: false # 必须可见窗口方便人工过验证执行python run.py -c config.yml后终端进度条会实时显示各线程状态完成后Downloaded/下按作者名/模式/日期_标题_aweme_id分层存放根目录同时追加一份清单文件。 浏览器兜底翻页被风控时的手动通道它做什么API 翻页触到风控时自动启动 Chromium从页面滚动采集作品 ID再回头补齐视频详情风控弹窗会出现在真实浏览器窗口里由人完成验证。怎么用配置里保证browser_fallback.enabled: true且headless: false被拦截的任务运行到一半会挂起等待别提前关窗口。适合谁批量拉取单个博主全部内容、动辄几百条作品的场景。需要留意的是该通道目前只在post模式上完整验证过like/mix/music仍依赖 API 翻页。 增量同步第二次运行只拿新作品它做什么按磁盘上的主媒体文件判断是否下载过已存在且非空的直接跳过不会反复刷盘。怎么用increase.post置为true即可上例配置里已包含想强制重下某条作品删掉它对应的媒体文件再跑一遍。SQLite 历史记录不参与跳过判断它只负责留痕。适合谁需要持续追更某个博主、每周跑一次任务只希望目录里多出新内容的人。⏱️ 只拉取指定时间窗内的作品它做什么按作品发布时间过滤start_time与end_time圈出日期区间区间外的作品不发起下载。怎么用两个字段都写YYYY-MM-DD格式缺省为空则不过滤。适合谁做阶段性素材归档比如只要这个季度发布的教程避免把整个主页拉一遍。 评论、转写与通知让下载产物可直接进工作流它做什么comments.enabled: true会为每个作品额外生成_comments.jsontranscript.enabled: true走 OpenAI 转写接口输出transcript.txt与transcript.json仅视频生效图文笔记不生成notifications支持 Bark、Telegram 和任意 Webhook企业微信/飞书/钉钉机器人都可以多个通道并行推送、互不阻塞。怎么用三者都是配置块按需打开API Key 建议走OPENAI_API_KEY环境变量而不是写进 YAML。适合谁下载后还要做二次加工剪素材、喂模型、沉淀知识库的用户。把时间过滤、增量、评论、转写、通知叠在一起这套抖音批量下载工具就能当作一条长期运行的素材同步管线使用。️ 桌面版 Douzy把关注列表同步成下载队列图形版把同一套后端包成了三个平台抖音、TikTok、YouTube的工作台当前处于封闭测试阶段。关注页会同步你账号关注的博主给有新作品的条目打上标签可直接从列表发起下载收藏与喜欢页同步收藏夹和收藏合集每个合集卡片上都有下载整个合集按钮。任务中心则是所有下载任务的统一看板完成、失败、已取消分列展示失败条目给出10 件成功、2 件链接不可用这类明细可以打开输出目录或查看详情后重试。收藏类模式有两个约束值得提前知道collect/collectmix必须单独使用不能和post等模式混排它们只作用于当前登录 Cookie 对应的那个账号。 三个高频问题只拉到 20 条左右就停了。原因抖音翻页风控API 只放行第一页。 处理启用浏览器兜底headless: false弹窗里手动完成验证确认风控弹窗已消失前不要关窗口。任务卡住或提示未登录。原因Cookie 有有效期大约一周过期后接口会拒绝。 处理重新跑一次python -m tools.cookie_fetcher --config config.yml刷新即可不必改代码。进度条刷屏。原因进度阶段默认会打印大量日志。 处理progress.quiet_logs: true可以整体抑制需要调试时再临时加-v或--show-warnings。另外两点容易忽略单条下载失败会按 1s/2s/5s 退避重试retry_times控制总次数仍失败的会留在任务失败列表里等重跑目录规划上author_dir可选昵称、sec_uid 或昵称_uid三种命名重度用户建议用后一种避免作者改昵称后目录分裂。这个工具适合想把个人收藏夹、关注博主或某段时间的作品长期留在本地的用户命令行加 YAML 的路子对运维背景的人友好Douzy 则把同样的能力搬进了图形界面。它本质是个下载器所有能力建立在 Cookie 与平台接口之上接口变更导致功能暂时失效属于正常技术风险。下载内容请仅用于个人学习、研究与数据管理不要商用或二次传播尊重创作者版权并遵守平台规则。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表