
3个配置改完我的抖音批量下载不再翻车【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader凌晨一点我还在一个个点开博主的作品页右键另存为手动改名。存到第37个时我停下来看了一眼时间——这个动作我已经重复了近两个小时。第二天我花二十分钟跑通了 douyin-downloader一款面向实用场景的抖音批量下载工具去水印、按作者主页整批抓取、SQLite 自动去重剩下的三百多个视频在进度条滚动里全部落盘。那次之后我意识到真正耗时间的从来不是下载这个动作而是下载之前的找链接、下载之后的改名归档。这篇文章不打算做功能清单式的罗列我只讲我实际跑通过的东西它是怎么工作的、我改了哪三个配置、以及踩过的几个坑。一句话看懂它一台自带账本的传送带把它想象成一条传送带你负责把链接丢上去它负责后面所有事识别链接类型单条视频、图文、合集、音乐、作者主页、直播、挑无水印且码率最高的源、下载、按作者/模式/日期_标题_ID归档最后把每一笔记录写进一本账——账本就是 SQLite 数据库dy_downloader.db。账本的存在让两件事成为可能一是去重同一个作品换个链接再丢进来它翻账本发现存过直接跳过二是增量追更博主时只拉新作品不用每次全量重来。工具做了两次检查——数据库记录加本地文件名扫描所以哪怕数据库丢了它也能靠文件名里的 ID 认出哪些已经下过。二十分钟跑通第一次下载安装路径很短。克隆代码、装依赖然后准备 Cookiegit clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt python -m tools.cookie_fetcher --config config.yml最后一条命令会弹出一个浏览器窗口登录抖音后回终端按回车Cookie 自动写进配置。这一步不能省——不带 Cookie 的请求拿不到完整权限很多接口会直接拒绝。最小配置只需要几行link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx # 作者主页链接 mode: - post # 下载作者发布的作品 number: post: 0 # 0 不限制数量 thread: 5 database: truenumber里的0是全文最容易被忽略的设定后面细说。运行python run.py -c config.yml进度条就开始滚了。第一次跑通时我盯着终端看了很久不是因为感动是因为它把所有流程讲得很清楚解析链接、抓作品列表、跳过已存在、下载中、完成。跑完一个作者主页后我检查了输出目录每个作品一个文件夹里面躺着 mp4、封面、背景音乐、作者头像和一份完整的 JSON 元数据——标题、点赞数、评论数、发布时间都在里面。这对我来说是意外之喜我的素材库顺带拥有了可检索的索引。三个让体验质变的细节这几个配置在 README 里都有但没人告诉你它们值得单独调。number 设为 0才真正进入全量模式默认情况下每种模式的下载数量就是 0代表不限量很多人会照抄别人的配置填 50、100以为那是推荐上限结果每次只下到一半就停。我的做法是批量场景一律填0让它抓完因为跨模式自动去重——同一个作品在 post、like、mix 里重复出现也不会下两遍多抓没有成本。只能抓到 20 条时让浏览器兜底过验证码翻页到 20 条左右停住是抖音对 API 分页的风控不是工具坏了。解决办法是把浏览器兜底打开browser_fallback: enabled: true headless: false # 弹窗出现时手动完成验证别关窗口这时工具会在 API 抓不动时自动切到浏览器滚动抓取弹出的验证页面手动滑一下就过去了。我一开始嫌麻烦没开浪费了一个晚上开了之后一个上千条作品的博主主页一次抓完。增量下载加命名模板素材库不用手动整理追更的场景下全量重下纯属浪费。配置里加上increase.post: true依赖database: true每次跑只处理上次之后的新作品。再配合命名模板filename_template: {date}_{title}_{id}和folderstyle: true输出目录会自动长成作者/模式/日期_标题_ID的结构省掉了自己改名归档的全部功夫。顺带一提如果后续想在别的设备上管理这些素材项目还带了一个内测中的桌面版 Douzy粘贴链接即可下载任务状态、作品档案都在界面上适合不爱敲命令的人。踩坑笔记我替你踩过的几个坑想重新下载某个作品却怎么都不触发。它的去重是数据库记录 本地文件双重检查只删数据库或只删文件都不行两处都要清掉否则它总能找到下过它的证据。Cookie 突然大面积失败。抖音的登录态有有效期失效后重新跑一次python -m tools.cookie_fetcher --config config.yml就好不用改任何其他配置。下载完成却没有转写文件。转写功能只对视频作品生效图文不会生成 transcript另外确认transcript.enabled: true且OPENAI_API_KEY已配置三件事都对了才出文件。直播录制后只有一个 playlist 文件。HLS 源保存的只是播放列表需要 ffmpeg 做后处理FLV 源才是直接可播的选流的时候优先 FLV。写在最后工具不会替你判断哪些内容该存、哪些不该存它能做的是把你从复制粘贴的重复劳动里解放出来让你把时间花在真正需要判断力的事情上。合规使用、尊重创作者、控制请求频率这些底线和效率同样重要。下一步很具体把上面的最小配置存成config.yml先跑一个你最喜欢的博主试试。从第一个作品落盘开始你就知道这个工具值不值得继续用了。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考