资讯动态

5分钟跑通抖音批量下载:douyin-downloader 完整上手与避坑清单

发布时间:2026/8/15 14:54:09 来源:尧图企业网站定制
5分钟跑通抖音批量下载douyin-downloader 完整上手与避坑清单【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader如果你曾经为了存一支视频先打开网页、再点开解析站、忍受水印和画质压缩最后还得手动改文件名那这篇文章就是为你写的。douyin-downloader 是一款主打抖音批量下载的开源工具去水印、支持视频/图文/合集/音乐/直播它想解决的只有一件事把下载抖音内容从一小时的手工活变成一条命令的事。先别急着收藏你真正缺的是一次能跑通的批量下载回想一下你最常干的几件事看到喜欢的视频想存下来、某个博主更新太快想一次性收全、做课件需要一批同类素材、直播课结束想留档。单独做任何一件都不难难在重复。今天存 3 条、明天存 5 条加上命名混乱、重复下载、封面丢失攒到最后就是一堆没法用的文件。而批量场景更让人头大博主主页几百条作品手动翻页点保存手酸不说还容易漏平台对高频请求有风控脚本一跑就断好不容易下完了文件名全是乱码事后找都找不到。douyin-downloader 的做法是把解析 → 去水印 → 挑最高清 → 建目录 → 存元数据 → 跳过已下载这一整条链路自动化剩下的事交给你按回车。下面我们直接从能不能跑起来开始验证。第一次运行5 分钟把第一支抖音视频拿到手先别管复杂配置我们走最短路径。第 1 步装依赖需要 Python 3.8Windows / macOS / Linux 都行git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt第 2 步拿 Cookie。访问抖音接口需要登录态工具自带了自动获取脚本会打开浏览器让你扫码登录登录完回到终端按回车Cookie 会自动写进配置python -m tools.cookie_fetcher --config config.yml第 3 步写一个最小配置。新建config.yml把你复制的视频链接粘进去link: - https://www.douyin.com/video/7604129988555574538 path: ./Downloaded/ thread: 5 retry_times: 3 database: true第 4 步运行python run.py -c config.yml看到进度条走完Downloaded/目录里就会出现一个以日期_标题_id命名的文件夹里面是去水印的视频、封面图、背景音乐和一份 JSON 元数据。到这里你的第一个任务已经跑通了全程五分钟以内。想更省事命令行可以直接追加链接临时下载不用改配置python run.py -c config.yml -u https://www.douyin.com/video/xxxx -p ./Downloaded一张表看懂 douyin-downloader 的能力边界与适用人群第一次运行成功后你可能想知道它到底还能干多少事下面这张表按功能能力 适用人群整理方便你对号入座。能力一句话说明适合谁单条下载视频 / 图文 / 合集 / 音乐链接粘过去就下随手存视频的普通用户作者主页批量post作品/like点赞/mix合集/music音乐四种模式追更党、自媒体运营、竞品分析收藏夹导出当前账号的收藏作品与收藏合集批量备份想把点赞收藏沉淀下来的人直播录制直播链接直接录主播下播自动保留已录数据教学直播、活动留档评论采集每个作品额外生成一份_comments.json可含二级回复舆情观察、数据分析热搜榜 关键词搜索一条命令导出热搜榜 / 搜索结果到 JSONL选题策划、素材调研视频转写调用 OpenAI 接口自动出文字稿txt / json字幕、二创、笔记整理完成通知下载完推 Bark / Telegram / Webhook挂机批量下载的人REST API 服务提交 URL 返回任务 ID可查询状态想接入自己系统 / 团队协作的开发者它的去重是底层能力不是开关SQLite 数据库 本地文件名双重判断同一个作品在多个模式下也不会重复下载增量场景下只拉新增内容。这一点对批量任务至关重要后面实操时会看到它怎么帮你省时间。分步实操从环境准备到跑通第一个批量下载任务如果你需要的不只是单条视频而是一个博主的所有作品请按下面这套完整流程走。① 复制官方示例配置再改别从零手写项目自带一份带注释的完整配置先复制一份cp config.example.yml config.yml配置示例文件 里每个字段都有说明建议保留注释逐项看。② 按需配置下载什么把link换成博主主页地址用mode和number控制范围link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx mode: - post - like number: post: 100 # 每个模式下载多少条0 全量 like: 50想同时收合集和音乐把mix、music也加进mode即可。跨模式自动去重同一个作品不会下两遍。③ 决定要不要增量如果你会反复跑同一个博主比如追更开增量模式它只下载数据库里没有的新作品increase: post: true database: true # 增量依赖数据库记录务必开着④ 启动并观察输出python run.py -c config.yml -v-v会显示完整日志方便第一次跑的时候看清每个环节。下载完成后目录结构长这样Downloaded/ └── 作者名/ └── post/ └── 2026-08-01_作品标题_aweme_id/ ├── xxx.mp4 # 无水印视频 ├── xxx_cover.jpg # 封面 ├── xxx_music.mp3 # 原声音乐 └── xxx_data.json # 完整元数据⑤ 遇到翻页风控启动浏览器兜底批量翻页时平台可能弹验证码工具内置了浏览器兜底策略API 受限时自动切换到真实浏览器滚动加载弹窗出来你手动过一下验证即可。相关配置默认是开着的保持下面这样就好browser_fallback: enabled: true headless: false调参、增量与六个容易踩的坑常用参数速查命令行参数不多但每个都实用参数作用-u, --url临时追加下载链接可重复传-c, --config指定配置文件-p, --path指定下载目录-t, --thread并发数默认 5--hot-board [N]拉取热搜榜并导出 JSONLN 为条数上限--search 关键词按关键词搜索作品并导出 JSONL--search-max N搜索场景最多拉取条数--serve以 REST API 服务模式运行-v / --show-warnings逐步调高日志详细度性能怎么调并发数thread默认 5宽带充足可以调到 8但别盲目拉高平台有速率限制默认每秒 2 个请求调太高反而容易触发风控。重试策略retry_times: 3对应指数退避1s、2s、5s网络不稳定时提到 5 更稳妥。时间过滤只要某段时间的作品用start_time/end_time格式YYYY-MM-DD。静默日志progress.quiet_logs: true能让进度阶段不刷屏跑批量任务时观感好很多。六个容易踩的坑number默认只有 1示例配置里post: 1是拿来试水的想全量务必改成0否则跑完只有一条。只删数据库不删文件不会重新下载程序会扫描本地文件名里的作品 ID 去重反过来只删文件会触发重下。想彻底重下某个作品文件和数据都要清。collect/collectmix必须单独用收藏夹模式不能和post/like/mix/music混在一起跑。增量模式依赖数据库increase要生效database: true必须开着。直播 HLS 源只保存 playlistFLV 源可以直接播放HLS 源需要自己用 ffmpeg 做后处理。只抓到 20 条是风控信号别怀疑配置写错了确认浏览器兜底开着、弹出验证时手动完成别急着关窗口。三个真实场景的时间账场景一追更博主每天只花 30 秒运营同学每天要盯着 8 个对标账号的新作品。以前的做法是上班后逐个翻主页、手动下载一个人要花掉 20 来分钟。现在把这些主页链接写进配置、开increase.post: true再配一个 crontab 定时任务0 9 * * * cd /path/to/douyin-downloader python run.py -c config.yml download.log 21每天早上 9 点自动跑完增量人工时间从每天 20 分钟降到 30 秒看一眼日志确认没异常一周省下约 2 小时。场景二做课程素材库300 条案例一个下午变 25 分钟培训机构要按学科、年级建抖音案例库目标 300 条。手动流程是搜账号 → 翻作品 → 逐个下载 → 手动改文件名归类两个助教忙一个下午。改用工具后把几位老师的user链接写进link配合start_time按学期过滤、thread: 8并发下载一次脚本约 25 分钟跑完人力投入降了八成以上而且每个作品自带元数据 JSON后续按字段筛选、归档都不用再手工整理。场景三直播课留档断线也不丢已录内容直播结束没留底回放权限过期就再也找不回。工具支持直接录直播间配置live参数后max_duration_seconds: 0表示一直录到主播下播中间 CtrlC 或网络波动已录制的字节也会保留并自动提升为正式文件。实测一场 90 分钟的直播课录完直接得到 FLV 文件和直播间元数据快照无需人工守着录屏软件。高频问题快答四个拦路问题的标准解法Q1只下到 20 条作品后面全断了翻页风控最常见的现象。确认browser_fallback.enabled: true且headless: false弹窗出现后手动完成验证再让它继续不要秒关窗口。Q2Cookie 失效怎么办重新跑一遍python -m tools.cookie_fetcher --config config.yml扫码刷新即可。工具本身也能自动检测登录失效交互环境下会主动拉起浏览器重新登录并自动重试一次。Q3想重新下载某个作品为什么它一直跳过已存在双重去重机制在起作用。想重下需要同时清理本地文件文件名含作品 ID 的目录和数据库记录sqlite3 dy_downloader.db DELETE FROM aweme WHERE aweme_id xxx;。Q4开了转写却没生成文字稿依次检查四件事transcript.enabled是否为true、下载的必须是视频图文不转写、OPENAI_API_KEY或transcript.api_key是否有效、response_formats是否包含txt或json。想完整了解参数和场景项目里的 使用说明 和根目录的config.example.yml是两份最靠谱的参考遇到问题先查它们。现在就动手三步行动清单技术文章看得再多不如亲自跑一次。给你一份可直接照做的清单装环境克隆https://gitcode.com/GitHub_Trending/do/douyin-downloaderpip install -r requirements.txt顺手装好 playwright浏览器兜底和自动取 Cookie 都要用它。拿 Cookie 跑通首单python -m tools.cookie_fetcher --config config.yml扫码登录然后粘一条视频链接到config.ymlpython run.py -c config.yml确认下载成功。升级到批量 自动化换成博主主页链接调好mode/number/increase跑一次全量确认无误后再加定时任务和通知推送让它在后台替你干活。记住两句话批量下载的收益不在第一次运行而在第 100 次去重和增量是让你敢反复跑的安全网。从今天这支视频开始把重复的体力活交给工具把时间留给自己。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价