ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

5步搞定抖音评论批量下载:零基础从网页到Excel的完整上手攻略

5步搞定抖音评论批量下载:零基础从网页到Excel的完整上手攻略

5步搞定抖音评论批量下载:零基础从网页到Excel的完整上手攻略

【免费下载链接】TikTokCommentScraper项目地址: https://gitcode.com/gh_mirrors/ti/TikTokCommentScraper

上周五下午,朋友小周发来一条消息:"这条视频爆了,评论区一千多条反馈,老板让我今天整理出来……"她手动复制了一整天,晚上十点才勉强交差,第二天还因为格式乱被嫌弃。我把这件事讲给一位做社区运营的朋友听,她甩给我一个几乎被埋没的开源小工具——TikTokCommentScraper。这是一款不写代码也能用的抖音评论采集工具,打开浏览器控制台粘一段脚本,它就会自动滚完所有评论、展开二级回复,最后导出一份干净的 Excel,正是"抖音评论批量下载"场景下的实用选择。


先花一句话认识它

TikTokCommentScraper 不碰任何第三方接口,也不伪装爬虫。它只是把"滚动页面、点击展开、复制文字、整理表格"这四件你本来要手动重复的事,拆成两端脚本替你完成:浏览器端负责采集与格式化,本机端负责导出 Excel。你全程只需要复制、粘贴、双击,剩下的交给脚本。


实战:从打开视频到拿到表格

这一节跟着我完整走一遍流程,大约十分钟,你就能拿到第一份评论表格。整个过程分四步。

第1步:把项目拿到手,确认环境

打开终端,克隆项目:

git clone https://gitcode.com/gh_mirrors/ti/TikTokCommentScraper

拿到项目后你会发现,Windows 用户已经自带一套精简版 Python 环境(就在python38/目录里),双击.cmd文件就能跑,连 Python 都不用装。Linux 或 macOS 用户只需装两个小依赖:

cd src pip install -r ../requirements.txt

依赖只有pyperclipopenpyxl两个,几秒钟搞定。

第2步:把采集脚本"装进"剪贴板

在项目根目录双击运行Copy JavaScript for Developer Console.cmd。它的作用是读取src/ScrapeTikTokComments.js并把整段采集脚本复制到系统剪贴板。你会看到一行绿色提示 "Copied to clipboard!",到这里,脚本已经在你的剪贴板里待命了。

第3步:在浏览器控制台执行,等待三个阶段

这一步是核心,操作却很轻。打开任意 Chromium 内核的浏览器(Chrome、Edge、Brave 都行),进入你想采集的 TikTok 视频页面:

  1. 确认已登录,并手动滚动一下评论区,确认评论能正常加载;
  2. Ctrl+Shift+J(Mac 上是Cmd+Option+J)打开开发者控制台;
  3. 把剪贴板里的脚本粘贴进去,按回车。

接下来你会看到控制台开始滚动输出,整个过程分三个阶段:

  • 加载一级评论:脚本模拟人工滚动,不断把页面拉到评论区底部,触发 TikTok 的懒加载,直到没有新评论出现;
  • 展开二级回复:它会自动找出所有 "View replies" 按钮并逐个点击,把每条评论下的回复全部撑开——这就是大家常说的抖音二级回复抓取能力;
  • 格式化数据:读完所有评论后,整理成 CSV 结构,并复制回剪贴板。

最后控制台会打出"CSV copied to clipboard!",代表采集完成。评论越多耗时越长,几千条一般也只要几分钟。

第4步:一键导出 Excel

回到项目根目录,双击运行Extract Comments from Clipboard.cmd。它会读取剪贴板里的 CSV,转换后生成一个带时间戳的Comments_<时间戳>.xlsx文件,直接双击就能用 Excel 或 WPS 打开。

你拿到手的表格长什么样

表格开头是视频的整体信息:帖子链接、作者昵称、发布时间、点赞数、分享数、视频描述,以及一级/二级评论的数量。正文部分每一行是一条评论,大致长这样:

Comment Number (ID),Nickname,User @,User URL,Comment Text,Time,Likes,Profile Picture URL,Is 2nd Level Comment,User Replied To,Number of Replies 1,阿北,@aobei,https://www.tiktok.com/@aobei,"这个转场绝了,看了三遍",2小时前,128,https://...,No,---,2 2,橘子汽水,@juzi,https://www.tiktok.com/@juzi,"同款背景音乐叫什么?",2小时前,35,https://...,Yes,阿北,0

注意看最后三列:Is 2nd Level Comment区分一条评论是不是回复,User Replied To指明它回复了谁,Number of Replies统计每条一级评论收到多少条回复。这意味着你拿到的不是一坨文本,而是带层级关系的结构化数据,可以直接在 Excel 里筛选、透视,做抖音评论数据分析


如果你想处理更大规模、更复杂的场景

问:视频评论有几千条,滚动很久还在加载,能提速吗?可以。脚本里的loadingCommentsBuffer控制"连续多少次没有新评论就停止"的耐心值,网速慢时把它调大一点更稳;反之想快就调小。另外,采集前在浏览器设置里关掉图片加载,能明显减轻页面负担,滚动速度会快一截。

问:评论很多时浏览器越来越卡,怎么办?把任务拆开做。先采第一批 500~1000 条,导出后再采下一批;同时关掉其他标签页,给浏览器腾出内存。项目实测在中等配置笔记本上处理 3000 条评论时只是略有卡顿,并不会崩溃。

问:想换一台电脑继续用,脚本要重新配置吗?不用。脚本本身就存在项目里,整个项目复制到另一台设备就能继续用。建议用 Git 管理一份自己的副本,每次采集后把脚本、表格放到固定目录,方便回溯。


三个高频坑,踩到也别慌

坑一:评论没加载完,脚本就提前结束了。检查一下是不是网络波动导致评论区卡住。补救动作:手动把评论区滚到最底部,确认没有"加载更多"后再重新执行脚本,并把loadingCommentsBuffer从 30 调大到 50。

坑二:双击导出脚本时报错,或者生成不了 Excel。多半是剪贴板被新内容覆盖了。补救动作:不要复制任何新东西,回到浏览器重新执行一遍脚本,让 CSV 再次进入剪贴板;同时确认没有已打开的 Excel 占着同名文件。

坑三:抖音显示 750 条评论,导出来却只有 740 条。这是 TikTok 自身的限制,不是工具出错——它展示的数量本来就经常和实际渲染出来的不一致,脚本还会在表格里同时记录"实际条数"和"抖音声称条数"并算出差值,方便你核对。


常见疑问快答

Q:一定要用 Chrome 吗?只要是 Chromium 内核的浏览器都可以,比如 Edge、Brave;不支持的浏览器请手动另存脚本内容再粘贴。

Q:Windows 上真的不用装 Python?对,项目自带精简环境,双击.cmd即可;只有 Linux/macOS 需要按上文装两个依赖。

Q:采集会不会导致账号异常?脚本只是在页面上模拟滚动和点击,不发任何外部请求,与正常浏览无异;但建议单次采集控制在合理规模内,合规使用。


最后:数据怎么用,由你决定

工具能做的,是帮你把一天的工作量压缩成十分钟;而这一千条评论背后是用户真实的情绪、问题和期待,怎么读懂它们,仍然取决于你。也许你会用透视表看看哪类内容最容易引发讨论,也许你会找出高频关键词反推下一期选题——数据到了你手上,故事才刚刚开始。

接下来可以做的事:

  • 挑一个近期表现最好的视频,用这套流程完整跑一遍,看看实际数据和后台显示是否吻合;
  • 把导出的 Excel 用数据透视表按时间、按点赞数做一次排序,找出互动最高的几条评论;
  • 试着把项目文件夹做个备份,并给采集脚本标注版本,方便日后对比调试;
  • 遇到评论区加载慢的视频,按上文调整等待参数后再采集一次,对比两次结果是否一致。

记住,采集只是开始,把评论变成洞察,才是这一趟真正的收获。

【免费下载链接】TikTokCommentScraper项目地址: https://gitcode.com/gh_mirrors/ti/TikTokCommentScraper

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

返回列表