尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

抖音批量下载:如何无水印批量保存博主主页的视频

抖音批量下载:如何无水印批量保存博主主页的视频 抖音批量下载如何无水印批量保存博主主页的视频【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader如果你关注了一个做美食探店的博主想把 TA 最近的作品完整存到本地一条一条右键保存实在太慢——链接要手动复制、文件要手动重命名存到几十条就开始出错。开源项目 douyin-downloader 就是为这类场景准备的命令行工具把博主主页链接写进配置文件它会无水印地批量下载视频、图文、合集、音乐自动按作者和模式分好目录下过的内容不会重复下载。 它能下哪些内容先用一句话概括覆盖范围后面教程默认只用到其中最常用的几类单条视频、图文笔记、合集mix单个音乐原声博主主页批量作品post、点赞like、合集mix、音乐music登录态下的收藏夹内容collect / collectmix只能单独使用直播录制实验性保存 FLV 与房间元数据关键词搜索、热搜榜数据导出JSONL更多细节可以看仓库里的 README.zh-CN.md。 从克隆到第一次下载环境要求不高Python 3.8Windows / macOS / Linux 都可以。克隆项目并安装依赖git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt如果要用到浏览器兜底后面会讲和自动抓 Cookie需要装 Playwright一个能自动化操作浏览器的库和 Chromiumpip install playwright python -m playwright install chromium基于示例文件建一份自己的配置再自动获取 Cookie——它会拉起浏览器让你登录抖音登录完回终端按回车Cookie 就写进配置了cp config.example.yml config.yml python -m tools.cookie_fetcher --config config.yml手动也行登录抖音网页版从浏览器开发者工具里复制 Cookie 填进配置的cookies字段。打开config.yml最精简的能跑起来的配置长这样link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx # 博主主页链接 path: ./Downloaded/ mode: - post number: post: 50 # 只下最近 50 条0 表示全部 thread: 5 retry_times: 3 database: true执行下载终端里会看到进度条python run.py -c config.yml下载完打开Downloaded/文件已经按作者名/模式/日期_标题_作品ID/分好了文件夹。 值得留意的几个细节这几个点决定了它和下载完就丢一堆文件的脚本工具的差别。下过的不会重复下默认开启database: true时每个作品的下载记录会存进 SQLite 数据库配合本地文件做双重判断文件还在就跳过数据库里有记录但文件被删了会重新下载。另外increase选项支持增量拉取——只跳过已存在的把博主新发的内容补下来increase: post: true适合每周跑一次、只补新作品的用法。翻页被风控拦了会自己开浏览器抖音对连续翻页有限制常见表现是只能翻出前 20 条左右。配置里的browser_fallback会在 API 翻页受阻时自动拉起一个真实浏览器去滚动加载列表你可以手动在弹窗里完成验证browser_fallback: enabled: true headless: false # 保持有界面模式方便你手动过验证官方文档里也注明这条兜底路径目前只在post模式下经过完整验证like / mix / music 仍走 API 翻页。默认就是无水印、且挑最高画质解析阶段会自动优先选无水印的视频源并从码率档位里挑最高的一档不需要额外配置。换句话说你拿到的就是能拿到的最好画质。每个作品自带一整套元数据folderstyle: true默认时每个作品是一个独立文件夹里面除了视频本身还有封面_cover.jpg、原声_music.mp3、作者头像_avatar.jpg和包含作品数据的_data.json。开启评论采集后同目录还会多一个_comments.json。做素材库或数据分析时这些结构化文件比视频本体更有用。 它适合谁普通用户就是想把一两个视频存下来。把视频链接写进link直接跑就行单条链接也支持v.douyin.com这种短链。不想碰命令行的话项目还有桌面客户端 Douzy目前内测粘贴链接、管理下载队列都在界面上完成它的任务中心可以查看每个任务的进度、成功/失败数量失败的任务可以单独重试内容创作者典型用法是维护一份关注博主清单每个博主配postincrease: true定期跑一遍只补新作品再加comments.enabled: true就能顺手把评论存下来做选题参考。研究者 / 想接入自己的程序的人两个参数可以把搜索结果和热搜榜直接落成 JSONL 数据文件python run.py --search 关键词 --search-max 100 -p ./data python run.py --hot-board 30 -p ./data另外加--serve参数可以把它跑成 REST API 服务需另装 fastapi 和 uvicorn提交 URL 返回任务 ID方便嵌进自己的流水线接口定义在 server/app.py。⚙️ 让下载更稳的设置日常用默认值就够。量大或网络不稳时重点看这几项thread: 8 # 并发数默认 5网络好可以适当调高 retry_times: 5 # 失败重试次数默认按 1s/2s/5s 退避重试 timeout: 120 # 单任务超时时间秒 proxy: http://127.0.0.1:7890 # 需要走代理时填写 progress: quiet_logs: true # 进度阶段少打日志看进度条更清爽需要每天自动拉新内容的话用 crontab 排一个任务即可例如每天凌晨 2 点跑一次0 2 * * * cd /path/to/douyin-downloader python run.py -c config.yml download.log 21❓ 常见问题现象某博主明明发了几百条只下到 20 条左右。原因这是抖音翻页风控的典型表现API 拒绝继续翻页。 处理确认browser_fallback.enabled: true且headless: false浏览器弹窗出现后手动完成验证别急着关掉。现象突然开始大量失败或提示 Cookie 过期。原因Cookie 有有效期久了会失效。 处理重跑python -m tools.cookie_fetcher --config config.yml重新登录一次即可。现象下载速度上不去。原因多为网络波动或并发设置与实际带宽不匹配。 处理适当调低thread如果所在网络有 IP 限制配上proxy。现象想重新下载某个已经下过的视频。原因去重机制基于数据库记录 本地文件双重判断两处都在就会跳过。 处理删掉该作品的本地文件夹并删掉数据库里对应的记录库文件是dy_downloader.db表名aweme。⚖️ 使用边界把话说清楚这个项目的定位是技术研究、学习和个人数据管理。内容版权归原作者下载下来用于个人存档、学习、非商业分析没问题但不要用做二次分发、商用或规模化爬取干扰平台服务。工具自身也内置了克制——默认请求速率限制在 2 次/秒、默认并发 5 线程加上失败退避重试对平台的压力是可控的。平台接口或规则变化导致功能失效属于正常的技术风险以仓库 README 的免责声明为准。最后把仓库克隆下来、配好 Cookie、扔一条博主链接进去第一次下载大概十分钟内就能看到完整流程。跑通之后按需翻一翻increase、comments、browser_fallback这几项配置基本就够覆盖绝大多数个人场景了。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表