资讯动态

抖音批量下载工具 douyin-downloader:视频、合集与主页去水印下载完整指南

发布时间:2026/9/16 11:27:15 来源:尧图企业网站定制
抖音批量下载工具 douyin-downloader视频、合集与主页去水印下载完整指南【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader想把一整套抖音合集、一位作者的主页作品完整存到本地douyin-downloader 是一个开源的去水印抖音批量下载工具支持视频、图文、合集与原声音乐。配置好链接后它会自动并发下载、去重、失败重试并连带元数据一起归档到本地。这是什么工具定位与适用人群douyin-downloader 是一个 Python 命令行下载器覆盖单个视频、图文、合集、用户主页四类链接另支持音乐原声与直播录制实验性。它面向需要定期归档抖音内容的自媒体运营者、研究者和个人收藏者解决的正是手动逐条保存效率低、链接易失效、重复下载浪费流量、下载后没有元数据可查这几个问题。所有能力围绕一份config.yml配置展开运行入口只有一条命令python run.py -c config.yml。抖音下载工具安装步骤四步跑通第 1 步获取代码并安装依赖Python 3.8macOS/Linux/Windows 均可。git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt第 2 步复制并填写配置。把示例配置复制为正式配置至少填link要下载的链接和path保存目录cp config.example.yml config.ymllink: - https://www.douyin.com/user/MS4wLjABAAAAxxxx path: ./Downloaded/ mode: - post number: post: 50 # 下载该作者最新 50 条0 表示全量第 3 步获取 Cookie。工具通过 Cookie 访问抖音数据自动方式只需在弹出的浏览器里登录一次抖音回终端按 EnterCookie 会自动写入配置文件python -m tools.cookie_fetcher --config config.yml第 4 步开始下载。python run.py -c config.yml命令行也支持临时追加参数例如-u追加链接、-t 8临时改为 8 并发、-p指定输出目录。核心能力按使用目标拆解目标一主页作品批量归档结论一条主页链接 一个mode即可按维度批量拉取该作者的内容。post发布作品、like点赞作品、mix作者的合集、music使用过的原声四种模式可组合number.post/like/mix/music分别限制数量0为全量同一个作品跨模式出现时自动去重不会重复下载当前登录账号的收藏夹可单独归档link填https://www.douyin.com/user/self?showTabfavorite_collectionmode用collect收藏视频或collectmix收藏合集二者必须单独使用目标二整套合集一次存完结论合集链接粘进link即可工具会拉取合集详情并逐个下载其中全部作品。支持/collection/{mix_id}和/mix/{mix_id}两种格式文件统一落在作者名/mix/合集名/目录下合集内作品按「日期_标题_ID」命名配合number.mix: 0可拿到合集中未限量的全部内容目标三拿到无水印的高清片源结论默认走无水印源并按码率自动挑清晰档无需手动挑链接。自动选择无水印视频源video_quality可选original探测上传原片、highest默认最高转码档或指定1080p/720p等分辨率附属资源按需开关cover封面、music原声、avatar头像、json完整元数据下载完成后按Content-Length校验完整性不完整文件自动清理并重试目标四重复运行不浪费流量结论SQLite 数据库 本地文件名双重去重重跑只补漏。database: true increase: post: true # 增量模式已下载过的作品直接跳过每次运行还会追加一份download_manifest.jsonl清单记录日期、作者、标签、文件路径便于事后检索start_time/end_time格式YYYY-MM-DD按作品发布时间过滤只下载区间内的内容截图来自基于同一后端构建的桌面版 Douzy内测中界面为演示数据粘贴链接的交互与命令行配置一一对应。进阶用法跑通之后可以这样调时间范围、数量上限与自定义命名结论三类筛选器组合使用可以精确控制下载什么、存成什么样子。start_time: 2024-01-01 end_time: 2024-06-30 filename_template: {date}_{title}_{id} folderstyle: true # 每个作品单独建文件夹 author_dir: nickname_uid # 作者目录用昵称_sec_uid重名不合并、改名不分裂命名模板支持{id} {title} {author} {date} {year} {type} {mode}等变量模板里至少要含{id}download_pinned: true可把主页置顶作品也纳入下载想按关键词找素材而不下载直接跑python run.py --search 关键词 --search-max 100结果落 JSONL 文件大任务效率并发、重试与完成通知结论长任务把并发、代理、通知配好人就可以离开终端。thread默认 5 并发retry_times默认 3 次重试间隔按 1s/2s/5s 指数退避内置约 2 请求/秒的速率限制降低风控概率网络不稳时配proxy: http://127.0.0.1:7890走代理任务结束推送到手机Bark / Telegram / Webhook企业微信、飞书、钉钉机器人任选notifications: enabled: true on_success: true on_failure: true providers: - type: bark # 填入你的设备 key常见问题排查从现象到解法主页下载只抓到 20 条左右就停了现象mode: post的任务刚开个头就结束远少于作者实际作品数。原因接口翻页触发了风控后续页面拿不到数据这是官方接口的常见限制。解法确保browser_fallback.enabled: true且headless: false任务卡住时会启动真实浏览器继续翻页出现弹窗时手动完成验证、不要立刻关窗。浏览器兜底依赖 playwright需先执行pip install playwright python -m playwright install chromium。注意该兜底目前只对post模式完整验证like/mix/music仍依赖 API 正常分页。请求返回需要登录、数据抓不到现象批量任务大面积失败日志提示未登录或鉴权异常。原因Cookie 有有效期登录态过期后接口不再返回数据。解法重新执行python -m tools.cookie_fetcher --config config.yml登录刷新。建议把定期刷新 Cookie纳入例行操作尤其是长期挂机抓取的场景。重跑同一链接却全部跳过现象想重新下载程序却提示已存在、直接跳过。原因去重是数据库记录 本地文件名双重判断两边都认过才会跳过只删文件不删数据库程序扫描文件名中的 aweme_id 后仍会补下反之只删数据库则会触发重下。解法两条都清掉。单条作品rm -rf Downloaded/作者名/post/*_aweme_id/ sqlite3 dy_downloader.db DELETE FROM aweme WHERE aweme_id aweme_id;想整体重来删掉Downloaded/目录和dy_downloader.db即可。下载速度慢、偶发中断现象进度条长时间不动或个别文件反复失败。原因并发过高触发限速或本地网络到目标 CDN 的链路不稳。解法把thread降到 3、确认proxy配置正确、调大retry_times不完整文件会被完整性校验自动清理并重试不必手动处理。场景速览三个真实用法竞品内容监测。运营者把目标账号主页写入配置mode: [post]加increase.post: true周期性运行只拉新作品配合 Bark 通知新内容发布后手机上立刻收到。教学素材按学期归档。研究者把系列教程的合集链接配好start_time/end_time一学期的课程视频按发布时间自动排好序落盘json: true保留完整元数据方便引用。给自己收藏做备份。用user/self?showTabfavorite_collection加mode: [collect]把当前登录账号收藏夹里的视频批量备份到本地换设备也不慌。工作原理速写粘贴链接后发生了什么链接先过解析器。core/url_parser.py用正则识别链接属于视频、图文、合集、主页、音乐还是直播间v.douyin.com短链会先解析成真实地址再分发。解析结果交给下载器工厂core/downloader_factory.py按类型选择对应的下载器单视频、合集、主页、音乐各一套流程。所有接口请求统一经过core/api_client.py发出客户端自动处理签名与 msToken主页翻页受限时可以把aweme_id的采集交给真实浏览器兜底再回接口补全详情。下载阶段由control/目录下的限速器、重试器与并发队列协作默认 2 请求/秒的速率上限、指数退避重试、多线程排队下载。storage/负责落盘——媒体文件按「日期_标题_ID」命名SQLite 记录作品明细与任务历史download_manifest.jsonl追加可追溯清单。整条链路的产物就是你在Downloaded/下看到的结构化目录。结语找一个十来个作品的小合集把上面四步完整跑一遍再逐步加开时间过滤、增量与通知——这是最稳妥的上手路径。最后三件事请留意下载内容请用于个人学习、研究与数据管理尊重创作者版权与平台规则不要二次传播Cookie 会过期任务大面积失败时先刷新 Cookie 再怀疑其他原因dy_downloader.db是去重与增量的依据移动配置时记得把它一并带上【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价