ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Browser-Use 文件下载自动化实战:2个参数跑通全链路

Browser-Use 文件下载自动化实战:2个参数跑通全链路 Browser-Use 文件下载自动化实战2个参数跑通全链路【免费下载链接】browser-use Make websites accessible for AI agents. Automate tasks online with ease.项目地址: https://gitcode.com/GitHub_Trending/br/browser-use让 Agent 去 file-examples.com 下载最小的 DOC 文件文件自动落到~/Downloads/tmp全程无人值守——这就是 Browser-Use 文件下载自动化的核心效果。你只需要给它一个自然语言任务和一个downloads_path剩下的导航、识别、落盘由库里的下载监控器包办。先跑通一份能直接复制的最小脚本 ⬇️下面这段脚本做一件事让 LLM 驱动的 Agent 访问示例站把最小的 DOC 文件下下来。import asyncio import os from browser_use import Agent, Browser, ChatGoogle # 用 Gemini 做决策浏览器只负责下载落盘 llm ChatGoogle(modelgemini-2.5-flash, api_keyos.getenv(GOOGLE_API_KEY)) browser Browser(downloads_path~/Downloads/tmp) async def main(): agent Agent( taskGo to https://file-examples.com/ and download the smallest doc file., llmllm, browserbrowser, ) await agent.run(max_steps25) asyncio.run(main())运行成功后日志里会看到类似这样的两行说明文件已经落盘[DownloadsWatchdog] ⬇️ File download starting: document-sample.doc [DownloadsWatchdog] ✅ Found downloaded file: /home/user/Downloads/tmp/document-sample.doc (251400 bytes)完整可运行的版本参考官方示例脚本 examples/features/download_file.py。能力拆解一条下载链路上的3个部件跑通之后回头看它为什么能跑通。整条链路只有3个部件。下载监控器浏览器一启动它就接管所有下载事件从开始、进度到完成全程跟踪详见 browser_use/browser/watchdogs/downloads_watchdog.py。浏览器配置downloads_path存在 profile 里没指定时自动建一个临时目录定义见 browser_use/browser/profile.py。事件系统FileDownloadedEvent在文件真正写盘后发出带上路径、大小、类型定义见 browser_use/browser/events.py。监控器的几个行为值得知道它用 CDP 回调捕获downloadWillBegin/downloadProgress启动时先对目录做一次快照新出现的文件才算下载天然防重复同名文件自动追加(1)、(2)不会覆盖。配置详解downloads_path 怎么写、task 怎么描述 先装环境仓库地址固定用 gitcode 镜像git clone https://gitcode.com/GitHub_Trending/br/browser-use cd browser-use pip install -e .downloads_path支持~展开、相对路径和绝对路径目录不存在会自动创建监控器启动时还会再mkdir一次兜底不传则落到系统临时目录。Browser(downloads_path...)只是语法糖等价于往 profile 里写同一个字段。task 的描述直接决定下载成败三个要素建议写全去哪个站点、要什么格式的文件、要几个。写得越具体LLM 越少在页面上兜圈子max_steps给到 20~30给多文件任务留足余量。进阶自动 PDF 与下载后处理 ⚙️profile 里auto_download_pdfs默认开启Agent 导航到 PDF 页面时监控器会通过浏览器内的 fetch 直接把 PDF 拉进downloads_path并按 URL 缓存去重同一个文件一个会话只下一次。后处理靠事件。监控器在每次落盘后发出FileDownloadedEvent载荷包含path、file_name、file_size、file_type、mime_type等字段字段定义见 browser_use/browser/events.py。拿到文件信息后后处理逻辑就交给普通的 Python 代码例如按扩展名把文件归档到不同子目录import shutil from pathlib import Path target Path(~/Downloads/tmp).expanduser() # 按后缀归档zip 另进解压目录 for f in target.glob(*.zip): shutil.move(f, target / archives)把这段换成解压、格式转换或上传云盘就是完整的下载后处理流水线。实战3个可以直接抄的任务 改 task 字符串即可代码不用动批量报表task访问内部报表系统下载2025年9月各部门财务报表每个文件确认下载完成——适合 Python 网页文件批量下载场景配合downloads_path指向专用目录下完直接按部门整理。邮件附件结合 Gmail 集成参考 examples/integrations/gmail_2fa_integration.py 的登录与二次验证处理task 写成检查收件箱主题含每日销售数据的邮件下载全部 CSV 附件AI 浏览器文件下载也能顺手把登录环节做了。多站点轮询task 里直接写死多个站点地址依次访问 A、B、C 三个站点各下载最新的月度报告 PDF一个 Agent 串行跑完文件按站点名归档。Browser-Use 文件下载自动化把点链接、等下载、收文件这段机械活压缩成了两个参数。想看完整示例从 examples/features/download_file.py 起步配置细节在 browser_use/browser/profile.py监控逻辑的边界情况都能从 browser_use/browser/watchdogs/downloads_watchdog.py 里读到。【免费下载链接】browser-use Make websites accessible for AI agents. Automate tasks online with ease.项目地址: https://gitcode.com/GitHub_Trending/br/browser-use创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表