十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

我把关注三年的博主作品全存进了本地硬盘:douyin-downloader 抖音批量下载实测

我把关注三年的博主作品全存进了本地硬盘:douyin-downloader 抖音批量下载实测 我把关注三年的博主作品全存进了本地硬盘douyin-downloader 抖音批量下载实测【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader上周五深夜我发现关注了三年的舞蹈博主删掉了一半早期作品。那些没来得及保存的视频就这样从互联网上消失了。当晚我装好 douyin-downloader把主页里剩下的两百多个作品连同原声、封面一起拉进了本地全程不到二十分钟。这篇记录的就是这次备份的完整经过——如果你也有舍不得丢的抖音内容它也许正好合适。一次真实的备份先从单个视频开始试水我的习惯是任何工具都先拿一个最小任务验证而不是一上来就全量跑。douyin-downloader 的环境安装比想象中短四条命令就位git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader/douyin-downloader pip install -r requirements.txt cp config.example.yml config.yml真正卡住新手的往往是 Cookie——抖音的内容需要登录态才能访问。好在项目自带自动获取脚本运行后会自动弹出浏览器python -m tools.cookie_fetcher --config config.yml扫码登录后回到终端按一下回车Cookie 就被写进配置并保存在本地不上传任何服务器。这一点我特意确认过才放心把账号信息交给它。接着我在config.yml里只放了一条视频链接link: - https://www.douyin.com/video/xxxxxxxxxxxx path: ./Downloaded/ music: true cover: true json: true运行python run.py -c config.yml几秒后下载完成。打开文件夹一个作品被拆成了四样东西无水印的 mp4、原声音乐、封面图、以及一份完整的元数据 JSON。视频、音乐、封面、信息一个不缺。第一次见到这种拆得很细的下载结果我就知道它和我以前用的在线解析站不是一类东西。把链接换成博主主页批量下载才真正开始单个视频跑通后我把链接换成了博主主页地址追加了下载模式link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx mode: - post number: post: 50 # 先下最近 50 个0 表示全部终端立刻变成一张进度面板每个作品一行标题、百分比、状态标签依次滚动默认 5 个并发线程全程没断过。更让我意外的是重复下载这件事。第二天我想补几个漏掉的作品把同一条命令又跑了一遍——结果几乎瞬间结束日志里全是已存在跳过。原来每个下载过的作品都被记进了 SQLite 数据库再结合本地文件做双重判断。批量下载一旦有了去重你就敢反复跑、放心跑。如果你只想收某个博主的背景音乐或想搬空他的合集、点赞列表改mode就行post是主页作品like是他点赞过的mix是合集music是原声音乐collect是自己收藏夹里的内容。同一个作品在多种模式下出现也不会重复下载。和它对比我过去用过的几种土办法差距很直观方式水印批量音乐/封面元数据在线解析网站部分有基本不支持无无录屏屏幕水印手动逐条无无浏览器插件常有单条为主少无douyin-downloader原生无水印主页全量独立保存完整 JSON不重、不断、不封那些藏在配置里的笨功夫批量下载最大的敌人不是网速是风控。抖音对高频请求的容忍度很低这个工具做了一组笨但有效的安排默认 2 请求/秒的速率限制失败的请求按 1 秒、2 秒、5 秒指数退避重试而不是死磕下载时比对文件长度不完整就自动清理重下。所以就算中途断网续跑一次缺的会补好的会跳。翻页风控是另一道坎。批量拉作者作品超过一定数量后接口可能只返回前 20 条。这时可以打开浏览器兜底browser_fallback: enabled: true headless: false它会启动一个真实浏览器慢慢往下翻遇到验证码就弹窗手动过一下即可。我就是用这个办法把那位博主只能抓到 20 条的合集完整拉了下来。如果想长期跟踪一个创作者增量模式更省事increase.post: true开启后每次运行只下载新增作品旧的不碰。再配合start_time/end_time还能只取某个时间段的内容。相当于给关注列表配了一个只进新货的同步器。顺手发现的能力直播、评论、热搜、API备份完主页作品后我翻了翻命令行参数发现它还管着不少副业直播录制把live.douyin.com的直播间链接放进配置指定时长即可录制主播下播或断网时已录的字节会保留不会白录。评论采集打开comments.enabled按作品抓评论还能带上二级回复输出结构化 JSON。热搜与搜索--hot-board 30抓热搜榜--search 关键词按关键词搜索作品结果落成 JSONL适合做内容观察。完成通知下载完可以推送到 Bark 或 Telegram跑批量任务时不用一直盯着终端。REST APIpython run.py --serve --serve-port 8000起一个服务用接口提交下载任务、查询状态方便接进自己的自动化脚本。这些能力单个拿出来都不算惊艳但都围绕同一个诉求把抖音内容搬到自己地盘这件事做到位。给同样想备份的你两个坑和一个建议如果你准备动手我的建议是从单个视频开始跑通再上批量。环境五分钟能装好但第一次把配置、路径、下载结果都确认一遍后面就顺了。两个最容易踩的坑提前说给你Cookie 会过期。下载时报 403 或未登录时八成是 Cookie 失效了重新跑一遍cookie_fetcher就行。有效期大概 7 到 15 天建议每周更新一次。批量拉太多被风控限流时别硬试。打开browser_fallback让浏览器兜底翻页弹窗出现就手动过验证比反复重试有效得多。回到开头那位博主。现在他的主页作品、音乐、封面都安静地躺在我的硬盘里按作者分目录、按日期命名想找哪个随手就能翻到。工具是免费的代码完全开源。它解决的其实不是能不能下载的问题——那很多工具都能做到它解决的是批量下载时能不能让人省心的问题不重复、不中断、不轻易被风控拦住。如果你也有舍不得丢的抖音内容趁还在把它存下来。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表