抖音批量下载工具实操笔记:10分钟跑通第一个任务,作者主页也能一键搬

📅 发布时间:2026/8/15 10:51:24
抖音批量下载工具实操笔记:10分钟跑通第一个任务,作者主页也能一键搬
抖音批量下载工具实操笔记10分钟跑通第一个任务作者主页也能一键搬【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader你有没有算过手动把一个博主的 200 条作品挨个保存下来要多久正常来说是一下午手还得在播放页—右键—另存为之间来回切换。而用 douyin-downloader 这个开源抖音下载工具同样的活只需要一条命令剩下的是等进度条走完。它免费、开源、支持去水印能处理视频、图集、合集、音乐甚至能把直播回放一起存下来。这篇文章就按一个新手从零上手的顺序把每一步拆给你看。先说清楚这个工具到底干了什么douyin-downloader 做的事情可以概括成一句话把抖音上你能看到的、公开的内容按你自己的规则批量存到本地。它不只是一个下载器更像一个内容管理助手单条视频、图文、合集、音乐贴链接就能下一个作者主页的所有作品、点赞、合集、音乐一次抓完直播中或刚结束的直播间能录成文件下载过的内容会被记录下次只补新的不重复占硬盘每个作品还会附带封面、背景音乐、作者头像和一份 JSON 元数据方便日后检索。下面按安装 → 首次成功 → 批量 → 进阶的顺序走一遍你在终端里照着敲就行。第一步把环境搭起来两条命令的事前提很简单一台装了 Python 3.8 以上的电脑Windows / macOS / Linux 都行。接着把项目拉下来git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader/douyin-downloader pip install -r requirements.txt第三条命令是装依赖正常情况下几分钟内完成。想用浏览器的兜底功能后面讲翻页限制时会用到再补装一个 Playwrightpip install playwright python -m playwright install chromium到这里环境就绪还不需要写任何配置。第二步第一次下载从一条视频链接开始先复制一份配置模板cp config.example.yml config.yml然后编辑config.yml把link换成你想下载的内容比如一条视频、一篇图文、一个合集都可以支持填多条link: - https://www.douyin.com/video/1234567890123456789 path: ./Downloaded/保存后运行python run.py -c config.yml程序会解析链接、拉取无水印源、下载视频同时把封面、背景音乐、作者头像和*_data.json元数据一并存进Downloaded/目录。第一次运行大概率会提示需要登录态别慌见下一步。关于登录 Cookie两种拿法抖音的接口需要带 Cookie 才稳定。新手最省事的方式是用工具自动获取python -m tools.cookie_fetcher --config config.yml运行后会弹出一个浏览器窗口你正常扫码登录抖音登录完回到终端按一下 Enter程序会把 Cookie 自动写进配置文件全程不用手动复制粘贴。如果哪天下载时提示登录失效重跑这一条命令即可。第三步批量下载一个作者主页全拿走单条链接只是热身。这个工具的招牌能力是抖音作者主页批量下载把主页链接填进去指定要作品 / 点赞 / 合集 / 音乐里的哪几类再设置数量剩下的交给它。link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx mode: - post - like - mix - music number: post: 50 # 最多下载 50 个发布作品 like: 20 # 点赞作品最多 20 个number里的数字是各类型的数量上限写成0表示不限制、全量抓取。下载完成后目录会自动按作者 → 类型分好类作品还会以日期_标题_ID命名一眼就能看出是什么Downloaded/ └── 作者昵称_secUID/ ├── post/ # 发布的作品 │ └── 2024-02-07_作品标题_aweme_id/ │ ├── ...mp4 │ ├── ..._cover.jpg │ ├── ..._music.mp3 │ └── ..._data.json ├── like/ ├── mix/ ├── music/ └── live/抓完整个主页后你得到的不是一堆乱七八糟的文件而是一个可以直接当素材库用的目录树。下载清单还会以download_manifest.jsonl的形式单独存一份每行一条记录包含作品 ID、标题、标签、文件路径方便后续写脚本二次处理。第四步直播回放赶上了就存下来直播这东西错过了就没了。douyin-downloader 提供了录制直播的功能支持 FLV 和 HLS 两种格式。配置也很直白link: - https://live.douyin.com/123456789 live: max_duration_seconds: 3600 # 最多录 1 小时0 表示录到主播下播 chunk_size: 65536 idle_timeout_seconds: 30运行后它会进直播间开始录主播下播、网络空闲或者你按 CtrlC 中断时已经录下来的数据会保留不会白忙一场。录完的 FLV 存在Downloaded/{作者}/live/下旁边还会附带一份*_room.json记录直播间信息。注意一点HLS 源目前只保存 playlist 文件需要自己用 ffmpeg 做后处理FLV 则可以直接播放。第五步增量下载硬盘和时间都省了批量下载最大的隐形开销是重复同一批内容下两次浪费流量也浪费空间。工具内置了 SQLite 去重开启增量模式后它会同时比对数据库记录和本地文件已经下过的自动跳过只补新的increase: post: true like: true mix: true music: true database: true这对定期更新某个博主的作品特别有用第一次全量抓之后每天跑一遍几秒钟就完成只把新发的作品补进来。如果你想强制重下某个作品删除对应本地文件、再清掉数据库里那条记录即可sqlite3 dy_downloader.db DELETE FROM aweme WHERE aweme_id 要重下的ID;进阶玩法按你的习惯定制基础流程跑顺之后下面这些选项能让你把工具调教成顺手的样子。只下某个时间段的内容适合补档某段时期的作品配置start_time/end_time即可格式YYYY-MM-DDstart_time: 2024-01-01 end_time: 2024-12-31自定义命名规则默认命名是日期_标题_ID想换成自己习惯的格式改模板就行filename_template: {date}_{title}_{id} folder_template: {date}_{title}_{id}下载完推送到手机下载任务在后台跑的时候可以用 Bark / Telegram / Webhook 把结果推给你notifications: enabled: true on_success: true on_failure: true providers: - type: bark url: https://api.day.app/YOUR_DEVICE_KEY热搜榜、关键词搜索与 API 服务这三个是工具感最强的部分# 拉取热搜榜前 30结果存成 JSONL python run.py --hot-board 30 -p ./Downloaded # 按关键词搜索作品 python run.py --search 猫咪 --search-max 100 -p ./Downloaded # 以 REST API 服务模式运行给别的程序调用 pip install fastapi uvicorn python run.py --serve --serve-port 8000API 模式下往/api/v1/downloadPOST 一个{url: ...}就能提交任务用GET /api/v1/jobs/{job_id}查询进度。如果你有自动化脚本或者想把下载能力接到自己的系统里这是最省事的方式。评论采集想分析一个作品底下的用户反馈可以开启评论采集每个作品会额外生成*_comments.jsoncomments: enabled: true include_replies: false # true 会连二级回复一起抓 max_comments: 500 page_size: 20常见坑与解决办法只能抓到 20 条作品这是抖音翻页风控的常见现象不是程序坏了。确认配置里browser_fallback.enabled: true且headless: false翻页卡住时浏览器会弹出来手动过一下验证码即可别急着关窗口。Cookie 失效、下载报错重新跑一遍python -m tools.cookie_fetcher --config config.yml更新登录态。下载速度慢把thread从默认 5 调高到 8 或 10如果本机网络访问抖音不稳可以配置proxy: http://127.0.0.1:7890走代理。日志刷屏默认progress.quiet_logs: true会静默阶段日志调试时再加--show-warnings或-v。怎么查下载历史数据库默认生成在dy_downloader.db直接查sqlite3 dy_downloader.db SELECT aweme_id, title, author_name FROM aweme ORDER BY download_time DESC LIMIT 20;桌面版 Douzy不想碰命令行的选择如果你完全不想看终端项目还基于同一套后端做了一个桌面客户端 Douzy目前处于内测期。粘贴链接就能下还能同步关注列表、可视化跟踪进度、在 SQLite 档案里筛选历史作品命名规则也可以在设置界面直接改。对新手来说桌面版的上手成本比命令行低一截。想深入看这几个地方配置全解douyin-downloader/config.example.yml每个字段都有注释是最权威的参考。完整功能列表douyin-downloader/README.zh-CN.md直播、评论、转写、API 等高级能力的说明都在里面。核心源码douyin-downloader/core/想搞懂下载流程和 URL 解析逻辑就从这里读起douyin-downloader/storage/ 是文件落盘与数据库去重的实现。最短上手命令速查# 1. 拉代码装依赖 git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader/douyin-downloader pip install -r requirements.txt # 2. 复制配置并把 link 改成你的目标链接 cp config.example.yml config.yml # 3. 自动获取登录态首次必做弹窗扫码后回终端按 Enter python -m tools.cookie_fetcher --config config.yml # 4. 开下 python run.py -c config.yml把下载当成一件一次性配置、长期复用的事是这类工具最值得的地方。最后提醒一句请把这些能力用在个人学习、资料备份和内容研究上尊重创作者版权也遵守平台规则——好工具值得被好好使用。现在去粘一条链接试试看吧。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考