ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

抖音批量下载工具 douyin-downloader 上手全记录:从第一条视频到批量自动化

2026/8/16 14:00:13 拓冰建站 浏览量
抖音批量下载工具 douyin-downloader 上手全记录:从第一条视频到批量自动化 抖音批量下载工具 douyin-downloader 上手全记录从第一条视频到批量自动化【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader晚上十点剪辑师小林合上电脑。为了给下个月的探店合集攒素材他连续一周每晚手动打开博主主页、逐条点开保存五十多条视频让他眼睛发酸。而他的同事只用了一下午就完成了同样的事——秘密就藏在 douyin-downloader 里一个开源的抖音批量下载工具支持去水印、作者主页批量下载、自动去重还能顺带把封面、原声和 JSON 元数据一起归档。如果打一个生活化的比方douyin-downloader 就像一位熟悉抖音规则的搬运工你把链接或作者主页交给它剩下排队、取货、验货、归档这些事都由它完成你不需要守在屏幕前。它默认带进度展示、失败重试、SQLite 去重、下载完整性校验和浏览器兜底另外还提供可选的桌面版客户端Douzy内测中和 REST API 服务模式。这篇文章按一条真实的使用时间线来写从装环境、取 Cookie 到第一次成功下载再一步步升级到批量与自动化。你可以照着顺序操作也可以直接跳到需要的章节。首次运行前花十分钟做好的两件事装依赖与取 Cookiedouyin-downloader 需要 Python 3.8 以上的环境macOS、Linux、Windows 都能跑。安装分两步git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt如果想用浏览器兜底翻页被风控时自动打开浏览器、人工过验证码再补一个 Playwrightpip install playwright python -m playwright install chromiumCookie 是访问抖音接口的钥匙推荐用项目自带的工具自动获取python -m tools.cookie_fetcher --config config.yml命令会拉起浏览器让你登录抖音登录完成后回到终端按回车Cookie 自动写进配置。相比手动复制粘贴这方式省心很多以后 Cookie 失效了重跑一遍即可。用一条链接完成第一次下载配置文件与三个关键参数先复制一份默认配置cp config.example.yml config.yml然后编辑它把link换成想下载的内容。单条视频最省事link: - https://www.douyin.com/video/7604129988555574538 path: ./Downloaded/运行python run.py -c config.yml终端会依次显示正在获取作品数据、批量下载进度和最终统计一次下载就此完成。如果你更习惯在命令行临时指定也可以用-u追加链接、-t调整并发数、-p指定保存目录python run.py -c config.yml -u https://www.douyin.com/video/7604129988555574538 -t 8 -p ./Downloaded下载完成后保存目录里会出现作者名文件夹里面按作品维度组织目录。下载目录里到底存了什么mp4 之外的完整清单douyin-downloader 下载的不只是一个视频文件。以视频作品为例每个作品目录下通常会有Downloaded/作者名/post/2024-02-07_作品标题_aweme_id/ ├── xxx.mp4 # 无水印视频源自动选最高码率 ├── xxx_cover.jpg # 封面图 ├── xxx_music.mp3 # 原声音乐 ├── xxx_data.json # 完整元数据 └── xxx_avatar.jpg # 作者头像这份附赠品对做资料库的人很有价值JSON 元数据里带着标题、点赞数、评论数、发布时间等结构化信息方便后期检索与统计分析封面和原声让素材复用时不用再回平台找。配合filename_template: {date}_{title}_{id}这类命名模板文件名可以完全按你的习惯生成。文件层面之外还有两道防重复的保险SQLite 数据库记录下载历史本地文件名里的 aweme_id 会被扫描识别两者结合同一个作品无论以什么方式再次出现都会被跳过。下载过程中还会做完整性校验按 Content-Length 比对文件大小不完整的文件会被自动清理并重试。一次配置批量收割作者主页四种模式怎么选真正的重头戏是作者主页批量下载。把 link 换成作者主页再通过mode声明要抓哪些内容link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx mode: - post # 作者发布的作品 - like # 作者点赞过的作品 - mix # 作者创建的合集 - music # 作者使用的原声音乐 number: post: 0 # 0 表示不限制数量全量抓取 thread: 5 retry_times: 3 database: true几个实用细节number对应各模式的数量上限写 0 就是全量设置具体数字则只抓前 N 条。跨模式自动去重同一个作品既出现在post又出现在like时只会下载一次。增量下载用increase.post: true配合database: true下次运行只抓新增作品——再配上系统定时任务Linux 的 crontab 或 Windows 任务计划程序就能实现每天自动更新。start_time/end_time可以做时间过滤只保留某个时间段的作品收藏夹内容则通过/user/self?showTabfavorite_collection链接配合collect/collectmix模式导出注意这两个模式要单独使用不能和 post 等混用。从手动到自动热搜、评论、通知与接口化的四种用法当批量下载本身稳定下来后工具还提供了几条向自动化延伸的路径热搜榜与关键词搜索python run.py --hot-board 30 -p ./Downloaded拉取热搜榜python run.py --search 猫咪 --search-max 100按关键词搜索结果落成 JSONL 文件适合做选题调研。评论采集开启comments.enabled后每个作品会额外生成*_comments.json可选是否拉取二级回复。完成通知notifications支持 Bark、Telegram 和 Webhook批量任务跑完主动推送到手机不用一直盯着终端。REST APIpip install fastapi uvicorn后运行python run.py --serve --serve-port 8000通过/api/v1/download提交链接、/api/v1/jobs查询任务状态方便把下载能力接到自己的系统里。直播场景也有对应能力把live.douyin.com/{room_id}放进 link可录制直播为 FLV主播下播或中断时已录制的数据会保留HLS 源只保存 playlist 文件需要用 ffmpeg 后处理。如果你不喜欢命令行内测中的桌面版 Douzy 提供了粘贴链接即下载、任务中心、作品档案筛选等可视化界面底层用的是同一套下载后端。手动一条条保存和工具批量下载差距在哪维度手动逐条保存douyin-downloader单条视频打开网页 → 等待加载 → 另存为粘贴链接一条命令完成批量获取逐条翻页、逐条另存极易漏配置作者主页自动翻页抓取重复下载全凭记忆容易重复SQLite 文件名双重去重文件命名浏览器默认乱码自定义模板规则统一元数据基本没有封面、原声、头像、JSON 齐全中断恢复已下的和没下的分不清完整性校验损坏自动清理重试定期更新人工重来一遍增量模式 定时任务这张表并不夸张——批量场景下去重和命名规范这两项往往比下载本身更省时间因为它们直接决定了素材库后期好不好用。老手私房话六个值得提前知道的细节只能抓到 20 条这是翻页风控的典型信号。确保browser_fallback.enabled: true、headless: false浏览器弹窗出现后手动完成验证不要立刻关窗口。Cookie 失效了重跑python -m tools.cookie_fetcher --config config.yml即可无需手工改配置。想重新下载某个作品程序同时查数据库和本地文件两者都要清理才会真正重下只删数据库不会触发因为文件名里的 aweme_id 仍在。终端刷屏难受默认progress.quiet_logs: true已静默进度日志需要排查时再临时加--show-warnings或-v。收藏夹模式不能和其他模式混用collect/collectmix必须单独配置。开了 transcript 却没生成文字稿依次检查enabled是否为 true、下载的是不是视频图文不转写、API Key 是否有效、response_formats是否包含txt或json。写在最后douyin-downloader 的学习曲线并不陡一个下午的时间足够你从第一次装好环境走到定时自动更新素材库。建议从一条单视频链接开始验证流程再逐步引入作者主页批量、增量与通知最后按需接入评论、热搜或 REST API。最后提醒一句工具是为技术研究和个人数据管理设计的。下载和整理内容时请尊重原作者版权与平台规则只保存自己有权使用的内容——把效率用在对的地方工具才会真正成为帮手。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考