news 2026/8/28 16:25:16

抖音批量下载一次跑完:douyin-downloader 十分钟抓空一个博主主页

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
抖音批量下载一次跑完:douyin-downloader 十分钟抓空一个博主主页

抖音批量下载一次跑完:douyin-downloader 十分钟抓空一个博主主页

【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader

素材库越攒越乱:常追的博主一天更新三条,逐条另存、去水印、重命名。自从用 douyin-downloader 做抖音批量下载,这块活从"一下午"缩成"一杯茶"。

能干什么,边界在哪

  • 四类内容一次抓全:视频、图集、合集(mix)、原声音乐(music)的抖音去水印下载,自动挑选无水印、最高码率的源
  • 自动归档:文件按作者/模式/日期_标题_作品ID整理,每个作品附带封面、头像和 JSON 元数据(标题、发布时间、播放/点赞/评论数)
  • 内置去重:SQLite 数据库记录每个已下载作品 ID,二次运行只捞新增内容
  • 边界说清楚:需要抖音登录 Cookie(一次配置,长期有效);翻页触发风控时需要人工在浏览器里过一下验证码,不会无人值守

原理一句话

数据流很像物流中转站的分拣线:每个作品是一件包裹,工具逐件扫条码(作品 ID)、撕掉广告贴纸(水印)、挑最大规格(最高码率)、归位到对应货架,再把运单号记进台账——同一件包裹下次再送进来,直接显示"已签收,免重拣"。

5分钟跑通:抖音批量下载环境搭建

安装 douyin-downloader

git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt

只想下几条单个视频的话,到这里就够用。打算长期追更、想开"浏览器兜底"(翻页被限流时自动拉起浏览器过验证码)和自动取 Cookie 的,再补装pip install playwright并运行python -m playwright install chromium

一次搞定抖音登录 Cookie

抖音 API 要登录态,工具自带自动抓取,跑一下就行:

python cookie_extractor.py

它会自己打开浏览器,你扫码登录、回终端按一下回车,Cookie 就写进配置文件了,全程不到一分钟,之后一直有效,失效了再扫一次即可。不想装 playwright 的话,项目里还有手动版脚本 get_cookies_manual.py,按引导从浏览器 F12 里把 Cookie 字符串拷出来贴进配置,效果一样。

配好主页链接,开跑批量下载

把 config.example.yml 复制为config.yml,改这几项就行:

link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx # 博主主页地址 path: ./Downloaded/ mode: - post # 发布的全部作品 number: post: 0 # 0 表示不限量 thread: 5 # 5 个任务并发 database: true # 开启数据库去重记录

然后执行:

python DouYinCommand.py

每个作品的进度、"跳过已存在"命中情况、最终成功率和总耗时,都会在终端实时刷出来:

进阶配置:增量下载怎么配、多模式一次抓

跑通之后,有两处配置值得花时间,一次设置、长期生效。

增量下载怎么配:只抓新增内容

追更最怕每次全量重下。把增量开关打开,工具会把已下载的作品 ID 记进数据库,之后每次运行只捞新增的——这就是一套抖音批量去重下载的标准姿势:

increase: post: true database: true # 增量依赖数据库记录 mode: - post # 发布的视频/图集 - like # 点赞过的作品 - mix # 创建的全部合集 - music # 用过的原声音乐

下周一再跑,只会抓博主上周末新发的几条,旧内容一笔带过。同一作品可能同时出现在"发布"和"合集"里,跨模式自动去重,不会重复占磁盘。

归档命名规则与桌面版替代

文件默认按作者昵称/模式/日期_标题_作品ID的目录结构归档,命名模板(filename_template)也能按你的习惯自定义。跑完之后留下的是一座井井有条的视频仓库,而不是一堆乱码文件名:

不喜欢终端的,项目还提供共享同一套后端的桌面版 Douzy——粘贴链接即刻开始,进度可视化跟踪,适合批量任务多、想盯着状态看的场景。

一个自媒体副业者的素材工作流

一位做"知识混剪号"的副业者,每周要收 8 位对标博主的新视频做剪辑参考。以前的固定流程是:逐个打开主页 → 手动另存 → 找工具去水印 → 重命名 → 拖进对应项目文件夹,每周固定烧掉 4 个小时,还经常漏抓、重抓。

现在他把 8 个主页链接一次性写进配置文件,打开增量模式,每周一早上跑一条命令,thread: 5并发下载,十几分钟全部收工:

  • 从 4 小时压缩到约 15 分钟,期间人完全不用守着
  • 增量模式保证只抓上一周的更新,不重、不漏
  • 素材按博主归档、按日期命名,剪辑找料十秒定位
  • 每周省下约 3 小时,全部还给脚本和剪辑本身

批量任务并发跑起来时,满屏进度条本身就很安心:

抖音批量下载避坑:3 个高频问题一句话解法

  1. 翻页翻到 20 条左右就断、抓不全:这是抖音翻页风控。确认已装好 playwright,浏览器窗口弹出时手动完成验证码,等它自己继续,别急着关。
  2. 提示 Cookie 失效、登录态无效:重新跑一遍python cookie_extractor.py,扫码 + 回车,几十秒搞定。
  3. 想重新下载某个旧视频:先删掉本地对应目录(目录名含作品 ID),再去本地 SQLite 数据库的 aweme 表执行DELETE FROM aweme WHERE aweme_id='作品ID'清掉记录,然后重跑即可。具体机制可以翻一下 USAGE.md 和源码。

现在就去克隆仓库,把常追博主的主页链接贴进配置,跑出你的第一批无水印素材。工具仅供技术研究、学习交流与个人数据管理使用,请在合法合规的前提下使用。

【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/8/28 16:23:50

AI协作开发中如何保持人的意义感与工程质量

在实际的 AI 辅助开发中,比模型选型和提示词技巧更先出问题的,往往是工作方式和心理感受。 When people think AI did the creative work, task meaning and effort decline 这句话描述了一个值得每个 AI 应用开发者、AI 编程工具使用者和技术管理者关…

作者头像 李华
网站建设 2026/8/28 16:21:29

10 分钟搭好免费游戏串流服务器:Sunshine 完整安装与配对指南

10 分钟搭好免费游戏串流服务器:Sunshine 完整安装与配对指南 【免费下载链接】Sunshine Self-hosted game stream host for Moonlight. 项目地址: https://gitcode.com/GitHub_Trending/su/Sunshine 游戏装在书房主机上,人却躺在客厅沙发里。Sun…

作者头像 李华
网站建设 2026/8/28 16:14:03

知网AIGC检测靠谱吗?从6个维度实测一遍

2026届论文提交季,不少同学收到知网AIGC疑似率报告后直接懵了:明明自己写的段落也被标了AI生成。这套检测系统到底准不准?我拿三篇不同学科的论文做了六项实测,结论放在最后。 一、为什么突然关心知网AIGC检测 今年3月起&#x…

作者头像 李华
网站建设 2026/8/28 16:13:35

多卡大模型微调实战:DeepSpeed ZeRO-2与Transformers Trainer集成指南

简介:在深度学习领域,大规模语言模型的训练与微调常面临显存不足的挑战。其核心原理在于模型参数、优化器状态、梯度和激活值对显存的巨大需求,传统单卡训练难以承载。为解决此问题,分布式训练技术应运而生,通过模型并…

作者头像 李华