FEATURED · 精选文章

用 douyin-downloader 完成抖音批量下载:一次从零到跑通的完整记录

发布时间 / 2026/8/14 11:02:51
来源 / 创域科博编辑部
栏目 / 资讯中心
用 douyin-downloader 完成抖音批量下载:一次从零到跑通的完整记录 用 douyin-downloader 完成抖音批量下载一次从零到跑通的完整记录【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader上周四晚上十点我接到一个剪辑需求第二天要交一段混剪素材得从某位创作者的抖音主页里挑而且要尽量清晰、不带水印。手动打开抖音逐条保存四十个视频一晚上未必收得完。后来我用了一个开源项目douyin-downloader——一个面向实用场景的抖音批量下载工具解决视频、图集、合集、音乐原声的去水印下载问题从安装到跑完全程没有踩出坑。这篇文章不写源码分析只记录我真实使用下来的过程怎么装、怎么配置、哪些参数值得注意以及它的边界在哪里。亮点快览去水印优先自动挑选无水印视频源并按码率数组选最高清的版本。类型覆盖全单个视频、图文、合集、音乐、用户主页批量、直播录制、评论采集都在支持范围内。下载有记性SQLite 数据库 本地文件双重去重配合增量开关第二次运行只下新内容。失败不白跑指数退避重试1s、2s、5s、下载完整性校验、翻页受限时的浏览器兜底。进度看得见终端有 Rich 进度条项目还附带一个桌面版客户端界面更直观。一次完整实战从克隆到跑通我的目标很明确把一位博主主页的作品全部下载同时要封面、音乐和元数据 JSON。下面是完整的操作记录。第一步安装依赖git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader/douyin-downloader pip install -r requirements.txt如果网络慢可以加清华镜像源。需要用到浏览器兜底功能的话再补装 Playwrightpip install playwright python -m playwright install chromium第二步获取 Cookie关键一步抖音的大部分内容需要登录态。项目提供了一个自动获取工具会打开浏览器引导你登录python -m tools.cookie_fetcher --config config.yml浏览器弹出后完成登录回到终端按 Enter程序会把 Cookie 自动写进配置文件。这一步比手动从浏览器 DevTools 里抠 Cookie 省事得多我强烈推荐先用它。第三步写配置文件复制示例配置再改几行就够了cp config.example.yml config.yml我最终用的核心配置如下link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx # 博主主页 path: ./Downloaded/ mode: - post # 只下发布作品0 表示全量 number: post: 0 thread: 5 music: true cover: true json: true第四步运行python run.py -c config.yml终端里会出现 Rich 进度条逐条显示作品状态。我那次 40 个作品的输出大致长这样已识别链接: 博主主页 开始获取作品列表... [ 1/40] 2024-12-30 19.37.12_男主这就50年了大地 视频: 12.3MB 无水印 封面: ok 音乐: ok 元数据: ok ... 下载完成: 40/40 用时 12分31秒整个流程比我预想顺。唯一要提醒的是先确认 Cookie 有效再跑长任务否则第一批请求就会报登录失效。三个容易被忽略的关键细节新手照着 README 通常能跑通但有几个细节决定体验好坏我单独拎出来讲。细节一命名模板值得花两分钟调默认的folderstyle: true会按作品维度建子目录文件名模板是{date}_{title}_{id}。这个组合我建议保留{id}否则遇到同名作品会互相覆盖。如果你长期跟多位博主author_dir的取值很关键author_dir: nickname_uid # 昵称_sec_uid直观且唯一默认的nickname最直观但博主改名会导致目录分裂重名则可能合并。nickname_uid是重度用户的首选。细节二增量下载依赖数据库别随手关掉increase.post: true可以让第二次运行只下新作品但它依赖 SQLite 记录。如果你把database: false关了增量判断就失去了依据。另外它和本地文件去重是两套机制只删数据库、不删文件 →不会重新下载程序会扫描文件名里的 aweme_id。只删文件、不删数据库 →会重新下载。想真正重下一个作品两边都要清。这个逻辑我第一次就理解反了特此记下来。细节三只抓到 20 条时是翻页风控在作怪抖音对未验证的翻页请求有限制常见现象是主页只能拿到前 20 条。解决办法是确保配置里有browser_fallback: enabled: true headless: false运行到翻页卡住时会弹出浏览器此时手动完成验证码别急着关窗口验证通过后程序会继续翻页。这个兜底目前主要针对post模式做了完整验证like、mix、music更多依赖 API 正常分页心里有数即可。适合谁用以及边界在哪里这个项目适合需要定期囤素材的创作者、做混剪的自媒体运营者、想备份自己作品的普通用户以及研究抖音接口的技术爱好者。它的局限我也如实说收藏夹模式collect/collectmix只支持当前登录账号且必须单独使用不能和post/like混着开。直播录制的 HLS 源只保存 playlist 文件需要自己用 ffmpeg 后处理FLV 可直接播放但 webcast 接口本身是实验性的。高频率、大规模抓取会触发风控这不是工具的缺陷而是平台规则使然。请合理设置thread和max_per_second。此外请记住下载功能只应服务于个人学习、素材管理与内容创作不要拿它搬运他人作品用于商业用途。常见疑问速答Q1为什么只能下载 20 条作品翻页风控所致。开启browser_fallbackheadless: false在弹窗里手动完成验证即可继续。Q2Cookie 失效了怎么办Cookie 有效期通常 7 到 30 天。重新执行python -m tools.cookie_fetcher --config config.yml几十秒就能换新。Q3怎么查看下载历史项目把记录写进了dy_downloader.db直接用 sqlite3 查询即可比如按下载时间倒序看最近 20 条也能按作者统计下载量。想深入了解内部实现可以看看douyin-downloader/core/下载主流程、douyin-downloader/storage/去重与数据库、douyin-downloader/config/配置加载这几个目录。最后说几句我用 douyin-downloader 前后下过两百多个作品最大的感受是它把下载这个重复劳动变成了一个可靠的批处理有进度、有重试、有去重断了重跑也不至于推倒重来。如果你也经常需要从抖音收集素材不妨按上面四步试一次成本也就十分钟。最后照例提醒请遵守平台服务条款与相关法律法规下载内容仅用于个人学习、研究和合理创作。尊重原创作者的劳动技术工具的价值在于辅助创作而不是替代创作。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED — 相关阅读

相关资讯

LATEST — 最新资讯

最新发布

TODAY — 本日精选

新闻

WEEKLY — 本周精选

新闻

MONTHLY — 本月精选

新闻