十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Browser-Use 文件下载自动化:3 个参数让 Agent 替你存好每一份文件

Browser-Use 文件下载自动化:3 个参数让 Agent 替你存好每一份文件 Browser-Use 文件下载自动化3 个参数让 Agent 替你存好每一份文件【免费下载链接】browser-use Make websites accessible for AI agents. Automate tasks online with ease.项目地址: https://gitcode.com/GitHub_Trending/br/browser-use做数据抓取时你肯定遇到过这种局面Agent 一路顺畅地点到下载链接文件却悄悄落进了系统临时目录脚本跑完你只得到一堆日志文件在哪全凭猜。用 Browser-Use 时不用自己写下载逻辑——只要在 Browser 配置里指定一个下载目录内置的 DownloadsWatchdog 会自动接管整个下载流程读完全文你就能让 Agent 稳定地把文件存进指定文件夹并拿到每个文件的路径。一句话看懂它如何工作你只管让 Agent 去点链接监控器在后台盯着浏览器的 CDP 下载事件文件开始下载、传输完成它都会把文件名、大小、最终路径打包成一个 FileDownloadedEvent 事件广播出去同时把路径记入会话的下载清单。换句话说存到哪和存没存上都不需要你操心。上手实操下载 file-examples.com 上的 DOC 文件落到指定目录场景很具体让 Agent 打开 file-examples.com把最小的 DOC 样例文件下载到本地某个目录。from browser_use import Agent, Browser # 只多这一行参数告诉浏览器文件存哪里 browser Browser(downloads_path~/Downloads/auto_downloads) agent Agent( task打开 file-examples.com找到最小的 DOC 文件并下载它, llmllm, browserbrowser, ) await agent.run(max_steps20)运行结束后~/Downloads/auto_downloads目录里会多出一个 doc 样例文件Agent 的返回消息里也会提到下载完成。想确认到底存了什么直接读会话记录# 一行拿到本次会话所有下载文件的绝对路径 files agent.browser_session.downloaded_files改成你的场景只动两处把downloads_path换成你要的目录比如报表归档路径把 task 里的网站和文件描述换成真实目标比如下载 9 月财务报表 PDF。完整可运行版本参考 download_file.py。最实用的3个配置下载落点 downloads_path作用决定文件存哪不填则落入系统临时目录的随机文件夹。怎么改传给 Browser 即可。改后效果Browser(downloads_path/data/reports/2025-09)每次运行前目录自动创建重名文件会自动加(1)、(2)后缀不会互相覆盖。PDF 自动抓取 auto_download_pdfs作用Agent 打开一个 PDF 链接时通常只是打开内置阅读器文件并不会落盘。怎么改该开关默认就是 True若被显式关闭则改回 True。改后效果监控器识别到 PDF 页面后直接通过 网络层嗅探 把文件抓下来无需 Agent 再点下载。下载事件 FileDownloadedEvent作用文件落地瞬间拿到回调里面有文件名、大小、完整路径。怎么改订阅会话事件总线。改后效果agent.browser_session.event_bus.register( lambda e: print(e.file_name, e.path) ) # 监听 FileDownloadedEvent 类型的下载完成事件适合做下载后归档、通知或触发下一步上传。避坑指南文件存到了随机临时目录现象运行完发现文件在/tmp/browser-use-downloads-xxx/里不是你的目标目录。原因没传downloads_pathBrowserProfile 会自动生成一个带 UUID 的临时路径。解法显式传入downloads_path并检查代码里有没有第二处 Browser 实例没带这个参数。同一个 PDF 重复下载只拿到一份现象让 Agent 连续下载多个相同链接的 PDF目录里只有一个文件。原因监控器对同一 URL 做了会话级去重缓存第二次请求直接复用已存文件。解法这是预期行为若确实需要多份给每个链接不同的查询参数或在下载完成回调里把文件复制一份再改名。把下载这件事交给监控器你剩下的工作只有读downloaded_files和做归档。想扩展玩法可以看 Gmail 附件相关集成 了解如何在真实业务里串联邮件附件下载。【免费下载链接】browser-use Make websites accessible for AI agents. Automate tasks online with ease.项目地址: https://gitcode.com/GitHub_Trending/br/browser-use创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表