尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

douyin-downloader 批量下载实战:从第一条无水印视频到千条任务全自动

douyin-downloader 批量下载实战:从第一条无水印视频到千条任务全自动 douyin-downloader 批量下载实战从第一条无水印视频到千条任务全自动【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloaderdouyin-downloader 是一款开源抖音批量下载工具主打视频、图集、合集、音乐的无水印下载内置 SQLite 去重、进度显示、重试与浏览器兜底。这篇文章会以一次真实摸索为主线带你从装好它开始一路走到定时自动下载把逐条手动存视频变成一条命令的事。深夜十二点我又一次在手动存视频先讲个画面你刷到一个很对胃口的博主一口气存了五六条视频。每一条都要复制链接 → 打开某个解析网站 → 跳过三秒广告 → 下载 → 重命名。更气人的是解析站给的文件要么糊成一团要么带着明晃晃的水印封面、原声、作者信息一概没有。存到第十条的时候你大概已经在想能不能有个东西把链接丢进去剩下的事全自动这个念头正是 douyin-downloader 存在的理由。它最初就是为解决抖音内容批量保存这个具体问题而写的现在已经是支持多种内容类型、带去重和兜底策略的成熟工具了。它到底能干什么一句话定位 一张表说清一句话定位输入抖音链接单条视频、博主主页、合集、直播按你的规则批量下载无水印原文件并把封面、原声、作者信息、JSON 元数据一并归档。它和在线解析站 手动操作最大的差异在三点智能去重不会重复下载浪费流量、完整元数据不只给你一个孤零零的 mp4、浏览器兜底API 被风控时自动换路。你能让它做什么解决的问题适合谁单条/主页/合集/收藏夹批量下载告别逐条复制粘贴想囤视频的普通用户视频、图集、音乐原声一并保存解决只有视频没有其他素材内容创作者、剪辑师SQLite 数据库去重 增量更新重复下载、重复占空间定期备份自己收藏的人直播录制、评论采集、AI 转写深度使用场景研究者、培训团队REST API / 命令行 / 桌面版接入自己的工作流开发者、企业第一幕 · 从零装好跑通第一条无水印视频安装不复杂三条命令的事git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt如果你在国内网络环境下安装依赖较慢给 pip 加上-i https://pypi.tuna.tsinghua.edu.cn/simple会快很多。抖音的接口需要 Cookie 才能稳定访问工具内置了自动抓取 Cookie 的小工具第一次跑前先装一下无头浏览器pip install playwright playwright install python -m tools.cookie_fetcher --config config.ymlcookie_fetcher会弹出浏览器让你扫码登录一次之后把 Cookie 写进配置后续下载就不用手动管了。接着建一个最小配置config.ymllink: - https://www.douyin.com/user/某个博主的链接 path: ./Downloaded/ mode: - post number: post: 10 thread: 5 database: truemode: post表示下载博主主页的作品number.post: 10限制只下 10 条thread: 5是并发数database: true开启去重。跑起来python run.py -c config.yml我第一次跑完看到的就是上图这种界面进度条实时滚动、跳过已存在的文件、结束时给出成功 x/x、用时统计。第一次下完先别急着删——去下载目录看看你会发现除了视频还有封面、头像和 JSON 元数据这个习惯后面会帮你省很多事。第二幕 · 批量模式的正确打开方式跑通第一条只是热身。这个工具真正值钱的地方是下面这几项能力。能力一一次喂多个链接多种内容类型同时下把链接写成列表mode 也写成列表一次任务就能同时处理多个博主、多种内容link: - https://www.douyin.com/user/博主A - https://www.douyin.com/user/博主B mode: - post # 主页作品 - like # 点赞过的内容 - music # 原声音乐 number: post: 50 like: 50 music: 20配合increase开关还能实现只下新的increase: post: true like: true技巧如果你在追更某位博主把increase打开后配合定时任务见第三幕每天跑一次就自动补齐新作品旧的不会重复下载。这就是 SQLite 去重的价值——它记得每一个已经下载过的作品 ID。合集mix/allmix、收藏夹collect/collectmix也走同一套配置逻辑把链接换成合集或收藏夹地址即可。下图是合集批量下载时的实际界面进度条按作品逐个刷新能力二下载的不只是视频而是一份完整档案默认配置下每个作品会保存无水印视频、封面图、原声音乐、作者头像、JSON 格式的完整元数据标题、点赞数、评论数、发布时间等。下载后的目录结构是这样组织的每条视频一个文件夹命名带日期和标题找起来非常省心。folderstyle: true会按作品单独建子目录如果你更习惯所有视频堆在一个文件夹把它关掉即可。技巧需要做数据分析的话json: true这一项别关。里面结构化记录了互动数据直接喂给 Excel 或脚本做统计都很方便。能力三API 被风控浏览器兜底 直播录制抖音对高频率请求有风控。工具的策略是API 优先、浏览器兜底——正常时走轻量 API遇到限制自动降级到浏览器模拟翻页。建议开启browser_fallback: enabled: true headless: false # 非无头模式方便你手动过验证这里我踩过坑把headless设成true后风控验证弹窗在后台默默等着任务就一直卡住。建议保持非无头模式弹窗出现后手动完成验证再继续。直播同样支持录制配置里加上直播链接即可link: - https://live.douyin.com/房间号 live: max_duration_seconds: 0 # 0 录到主播下播 idle_timeout_seconds: 30启动后它会列出直播间信息和可选清晰度选一个就能开始拉流录制全程不依赖 ffmpeg。第三幕 · 把它调教成你的专属下载器工具默认命名规则已经不错但你可以完全按自己的习惯定制。文件与目录命名filename_template: {date}_{author}_{title}_{id} folder_template: {date}_{title}_{id} folderstyle: true author_dir: nickname_uid可用变量包括date、author、title、id、like_count、comment_count等。关键提醒filename_template里必须保留{id}。它相当于文件的身份证用来判断这个作品之前下过没有。去掉它去重逻辑会失效还可能发生同名覆盖。author_dir有三个档位nickname直观但重名会合并、sec_uid稳定唯一但不直观、nickname_uid又直观又唯一重度用户推荐。按时间范围筛选start_time: 2024-01-01 end_time: 2024-12-31想只收集某段时间的作品时很实用。AI 转写与评论采集transcript: enabled: true model: gpt-4o-mini-transcribe api_key_env: OPENAI_API_KEY comments: enabled: true max_comments: 500 # 0 不限转写会为每条视频生成文字稿txt json做内容检索、字幕复用的场景很舒服评论采集则把热评按作品存成独立的 JSON 文件。下载完成通知notifications: enabled: true on_success: true on_failure: true providers: - type: bark url: https://api.day.app/YOUR_DEVICE_KEY支持 Bark / Telegram / Webhook跑批量任务时不用一直盯着屏幕下完手机会收到推送。三类人用它的三种姿势 个人收藏党困扰喜欢的视频散落在各处存下来的还带水印解法单条链接丢进去视频封面原声一次齐活推荐用法python run.py -u https://www.douyin.com/video/xxx 自媒体 / 剪辑从业者困扰每天要收集竞品素材、找热门 BGM逐条下载效率太低解法多博主多模式批量下载按author_dir自动归档到作者目录推荐用法配置文件里维护一份博主清单 increase: true每天增量同步 研究团队 / 培训机构困扰需要大规模样本还要结构化的互动数据解法热搜榜、搜索抓取配合 JSON 元数据数据直接可用推荐用法python run.py --search 关键词 --search-max 100 -p ./研究数据/ python run.py --hot-board 30 -p ./研究数据/如果你的系统想直接调它还能以 REST API 方式跑起来方便集成进自己的平台pip install fastapi uvicorn python run.py --serve --serve-port 8000高频疑问与翻车现场Q1为什么只能抓到前面 20 条作品诊断这是抖音翻页风控的典型现象属于限制而不是故障解决确认browser_fallback.enabled: true且headless: false浏览器弹窗出现后手动完成验证再继续不要急着关窗口Q2Cookie 失效了怎么办诊断长时间未使用登录态过期解决重跑一次 Cookie 获取即可python -m tools.cookie_fetcher --config config.yml重新扫码登录后任务自动恢复正常Q3下载速度慢或者个别视频失败诊断并发设太高容易触发限流视频本身被删除/设私密也会失败解决把thread降到 3~5retry_times提到 5失败的条目工具会自动跳过并继续事后用-v加 verbose 日志定位具体原因Q4明明下过的视频换个配置又全下了一遍诊断database被关掉或者命名模板里丢了{id}解决保持database: true并确认filename_template包含{id}Q5下载的文件命名乱糟糟找不到东西诊断默认模板信息不足或者没有开目录分类解决用{date}_{author}_{title}_{id}这类模板配合folderstyle: true按作品建目录为什么它值得长期留在你的工具箱聊点功能之外的东西。这个项目采用 MIT 开源协议意味着你可以放心使用甚至可以基于它改造自己的版本。仓库维护节奏比较活跃去重、直播录制、评论采集这些能力都是社区迭代过程中逐步长出来的不是一次性堆完就撒手不管的毕业项目。配套的桌面客户端也在内测中和命令行共用同一套下载核心。如果你不习惯敲命令桌面版可以粘贴链接直接开下还带任务中心往后的规划里还有 AI 标签、多平台支持、云同步等方向——对一个社区驱动的开源项目来说这意味着你现在学到的用法不会很快过时。如果你只是偶尔存几条视频那么建议你先跑通第一幕的最小配置体验一下一条命令下完整个博主主页的爽感如果你有定期追更、素材归档这类重复需求那么建议你直接配好increase 定时任务一劳永逸# 每天凌晨 2 点自动增量下载Linux/Mac 用 crontab 0 2 * * * cd /path/to/douyin-downloader python run.py -c config.yml download.log 21最后提醒一句技术是工具规则是底线。下载和保存内容前请留意相关版权与平台条款尊重创作者只在合法合规的范围内使用它。工具解决的是效率问题而如何用好始终取决于使用者自己。把第一条无水印视频下载下来的那一刻你大概就会明白这个工具真正省下的不只是那几分钟而是你以后再也不用为存视频这件事烦心。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表