十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

从收藏夹空转到本地整库:抖音视频批量下载的开源方案实测记录

从收藏夹空转到本地整库:抖音视频批量下载的开源方案实测记录 从收藏夹空转到本地整库抖音视频批量下载的开源方案实测记录【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader如果你也做过把喜欢的抖音作品批量存下来这件事大概会和我一样先碰一鼻子灰。上个月我盯上了一位专门拍苍蝇馆子的美食探店博主他的旅行Vlog和探店合集信息量极大我囤了上百条计划周末挨家打卡。结果某天再点开主页空空如也收藏夹里全是内容已删除。那一刻我决定认真找一个能解决抖音视频批量下载的靠谱方案——而最终让我安心的是这个完全开源、免费的工具 douyin-downloader。为什么手动存永远存不完先别急着搜下载教程不妨回答自己几个问题作品随时可能消失我存得过来吗答不上来。创作者的账号可能注销、隐藏、清理链接说失效就失效。而手动保存视频要么忍受右上角的水印要么用录屏软件——画质糊、声音差原声和封面信息更是完全拿不到。我下载了一百个视频然后呢没有然后了。文件名全是20230412_xKd...mp4这种天书想按作者归类、按日期排序、找出某个合集全靠肉眼和运气。有没有一个工具能一次解决水印、批量、整理三件事这就是 douyin-downloader 存在的意义。它是一套用 Python 写的开源命令行工具也配套了叫 Douzy 的桌面客户端支持单个视频、图集、合集、音乐、作者主页批量下载默认去水印、自动挑最高清源还内置了 SQLite 数据库负责去重和档案管理。下面我从一个纯小白的视角带你走一遍完整流程。第一次上手从装环境到跑通第一个下载任务先把项目拿到本地确保电脑里有 Python 3.8 或更高版本然后打开终端git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader/douyin-downloader pip install -r requirements.txt依赖装不动的朋友可以在 pip 命令后面追加-i https://pypi.tuna.tsinghua.edu.cn/simple用国内镜像加速这一步我卡了十分钟才反应过来。把登录态交给 Cookie抖音的接口要求带登录凭证工具提供了两种获取 Cookie 的方式。推荐用自动方式运行后会自动拉起浏览器扫码登录一次即可python -m tools.cookie_fetcher --config config.yml登录成功后回终端按一下回车工具会把 Cookie 加密写进配置。想手动填也行把浏览器里拿到的 Cookie 值粘进配置文件的cookies字段即可。Cookie 只存在你本地不会上传到任何服务器这点可以放心。写一份最小配置跑第一个视频复制一份模板再编辑cp config.example.yml config.yml打开config.yml保留这几行就足够起步link: - https://v.douyin.com/EXAMPLE1/ path: ./Downloaded/ music: true # 背景音乐要不要 cover: true # 封面图要不要 json: true # 元数据要不要然后执行python run.py -c config.yml看到进度条滚动、视频落盘的那一刻我第一次体会到了原来存抖音内容可以这么省心。工具的主界面桌面版长这样——粘贴链接、点一下检测剩下的交给它下载过程中你可以实时看到任务排到哪一步、还剩多久逐条事件日志清清楚楚把内容存下来它能接住哪些类型的作品工具能处理的不止是单个视频这一种情况我用一张表帮你理清输入内容支持情况单条视频 / 图文 / 图集/video/{id}、/note/{id}、/gallery/{id}单个合集/collection/{mix_id}、/mix/{mix_id}单个音乐原声/music/{music_id}短链自动解析https://v.douyin.com/...自动跳转解析作者主页批量下载/user/{sec_uid}配合mode: post/like/mix/music自己账号的收藏夹/user/self?showTabfavorite_collection直播间实时录制live.douyin.com/{room_id}FLV/HLS 双格式评论采集按作品抓取可含二级回复输出 JSON批量下载作者主页时配置只需这样写link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx mode: - post number: post: 50 # 最近50条写成0就是全部想连直播一起录把直播链接丢进link再配个时长上限就行link: - https://live.douyin.com/123456789 live: max_duration_seconds: 3600 # 录1小时0表示播到主播下播工具在解析直播流时还会让你选清晰度下面这张截图就是我实测时的输出除了视频本体它还顺手帮你把封面、原声音乐、作者头像、JSON 元数据一起存好——这些边角料往往是手动保存最容易丢的部分。另外--hot-board热搜榜和--search关键词搜索两个命令也值得一试# 抓热搜榜前30条 python run.py --hot-board 30 -p ./Downloaded # 按关键词搜作品最多100条 python run.py --search 宠物日常 --search-max 100 -p ./Downloaded把内容管起来下载完不等于结束存下来的东西如果乱成一锅粥那和没存没什么区别。这一层才是 douyin-downloader 真正拉开差距的地方。重复内容它会自己跳过工具内置 SQLite 数据库 本地文件双重去重。同一作者你下过两遍第二次它会自动识别已存在的作品并跳过只补新增的。想显式开启增量模式increase: post: true database: true文件自动归档目录清晰得像图书馆下载结果默认按作者 → 作品两层组织配合命名模板每个作品一个独立文件夹Downloaded/ ├── 美食探店博主/ │ ├── 2024-06-15_巷子里的老火锅_123/ │ │ ├── video.mp4 # 无水印视频 │ │ ├── music.mp3 # 背景音乐 │ │ ├── cover.jpg # 封面 │ │ └── info.json # 元数据 │ └── 2024-06-14_凌晨的拉面馆_456/ └── 旅行Vlog博主/ └── ...在配置里打开folderstyle: true即可按作品建子目录命名模板支持{date}_{title}_{id}这类变量组合在设置界面也能可视化调整时间过滤 作品档案只想留某位博主最近一个月的作品配置里加两行start_time: 2024-06-01 end_time: 2024-06-30工具只下载这个时间窗内的内容。所有下载记录都会沉淀进 SQLite 档案库按作者、标题关键词、类型、时间筛一筛就能找到常看博主区域还直接给你放了下载最新作品的按钮。档案界面长这样如果你关注列表很长桌面版还支持一键同步关注博主列表谁下载过、谁没下载过一眼就清楚让下载自动化跑起来之后就不用管了遇到风控浏览器兜底批量翻页偶尔会触发抖音的风控表现为只能抓到20条。此时启用浏览器兜底弹窗出来后手动过一下验证码即可browser_fallback: enabled: true headless: false失败会自动重试文件不完整会重新下工具内置指数退避重试1秒、2秒、5秒递进还会比对 Content-Length 做完整性校验——不完整的文件自动清理后重下。下载中断了也能接着下不用从头再来。开放 REST API方便接进自己的系统python run.py --serve --serve-port 8000一条命令就把工具变成 REST 服务提交下载任务、查询任务状态都能通过 HTTP 完成可选安装 fastapi uvicorn 增强体验。适合把下载能力集成到自己的脚本或服务器里。下载完成推送到你的手机配合 Bark 或 Telegram下载结束会实时推消息到设备上notifications: enabled: true providers: - type: bark url: https://api.day.app/YOUR_DEVICE_KEY - type: telegram bot_token: 123456:ABC... chat_id: 987654321顺带把视频转成文字稿需要给视频做笔记的话可以开启语音转写调用 OpenAI Transcriptions API每个视频会额外生成.transcript.txt和.transcript.json对我这种喜欢把探店讲解存成文字备忘的人非常实用。项目还提供了 Dockerfile服务器部署也很省事。几个我踩过的坑提前帮你避雷怎么突然 403 / 未登录了多半是 Cookie 过期了。它的有效期一般 7~15 天重新跑一遍python -m tools.cookie_fetcher --config config.yml就行。建议每周顺手更新一次。为什么只抓到20条作品翻页风控老熟人了。把上面的browser_fallback打开弹出浏览器后别急着关窗口手动过掉验证码再等它继续。批量下载很慢 / 老断线先确认网络稳定再把配置文件里的线程数默认5调一调同时记得它支持断点续传中断了接着下就好。下多了内存吃得厉害把并发线程调小或者分批下每次 50~100 条磁盘也建议预留 50GB 以上。直播 HLS 源下完打不开这是已知限制HLS 只保存 playlist 文件需要用 ffmpeg 转一下FLV 则可以直接播放。收藏夹模式报错collect/collectmix目前只能单独使用不能和post/like混在一起写进mode。最后说两句掏心窝的话说真的这个工具最打动我的地方不是某个单一功能而是一条龙无水印、批量、去重、归档、通知、API全给你配齐了还完全免费开源。你只需要花几分钟配好之后每一次想要收藏就是丢链接 → 回车 → 收工。我现在的习惯是看到值得长期保留的学习笔记、旅行Vlog、宠物日常或者探店内容顺手丢给 douyin-downloader周末统一归档整理。它像给抖音内容上了一道本地保险那份再也不用担心删号跑路的踏实感只有经历过收藏夹空空如也的人才会懂。当然也提醒一句下载的内容请用于个人学习、研究或备份尊重每一位创作者的劳动别拿去商用或侵权。工具本身是开源的用着顺手的话顺手给社区点个 Star、反馈个 issue就是最好的支持。打开终端吧你的第一个无水印作品正在等你。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表