ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

douyin-downloader 抖音批量下载工具:免费去水印,一个主页的作品一次收齐

douyin-downloader 抖音批量下载工具:免费去水印,一个主页的作品一次收齐 douyin-downloader 抖音批量下载工具免费去水印一个主页的作品一次收齐【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader上周我拿一位旅行博主的主页链接测了一遍 douyin-downloader两百多条作品全部无水印落盘封面、原声、元数据各就各位第二天再跑一次只补了新增的三条。这是个免费开源的抖音批量下载工具给个主页链接视频、图文、合集、音乐一次收齐还自带进度条、失败重试和下载去重。 先看清楚它能管什么一句话把抖音链接单条或整个主页变成你硬盘里分好目录的文件。核心能力如下能力说明内容类型单视频、图文note/gallery、合集、音乐原声v.douyin.com 短链自动解析批量模式主页作品 post、点赞 like、合集 mix、音乐 music、本人收藏夹 collect/collectmix无水印与画质自动挑无水印源可指定原画 / 最高转码档 / 指定分辨率批量管理SQLite 本地文件双重去重、增量下载只取新增、start_time/end_time 时间过滤稳定性指数退避重试1s/2s/5s、默认 2 请求/秒限速、Content-Length 完整性校验、翻页受限时浏览器兜底附加产物封面、音乐、头像、JSON 元数据、评论 JSON、可选 AI 转写、完成后推送通知适用人群一句话想系统性存档某位创作者的个人用户、需要定期盯竞品主页的运营、以及要结构化数据做研究的人。仓库里还有一版同后端的桌面客户端Douzy内测中。不想开终端的话它支持粘贴抖音链接直接开始下载还能同步账号的关注、收藏合集与喜欢列表。⚡ 三步跑通第一次下载装好依赖复制一份配置Python 3.8 即可Windows、macOS、Linux 都能跑git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt cp config.example.yml config.yml配置项看着多但 config.example.yml 里每一项都写了注释照着改就行。Cookie 一键获取抖音需要有效的 Cookie 才能稳定访问。不用手动从浏览器开发者工具里抠字符串直接跑 tools/cookie_fetcher.py 这个独立工具python -m tools.cookie_fetcher --config config.yml # 浏览器登录后回终端按 EnterCookie 自动写进配置 python run.py -c config.yml # 跑第一次下载它会弹出一个浏览器窗口登录抖音账号后回终端按 Enter凭证就写进 config.yml 了。想启用浏览器兜底后文会讲再装一下 playwrightpip install playwright加python -m playwright install chromium。跑完后去Downloaded/目录看成果按作者名/post/日期_标题_作品ID/分好层级视频、封面、元数据 JSON 都放在各自的文件夹里。 三个拿来就用的场景批量收走某作者的主页作品把link填成主页链接mode设为postnumber.post: 0表示不限条数。跑完得到一个按发布时间排好序的目录文件名自带日期_标题_作品ID前缀天然就是档案结构不用二次整理。只补新增的不重复下载把increase.post设为true依赖默认开启的database: true。之后再跑同样的任务工具会对照数据库记录和本地文件名双重复核已下的直接跳过只拉新作品——非常适合配成每周一次的定时任务。圈定时间段连评论一起抓做竞品分析时往往只关心某个阶段。配上start_time: 2025-01-01和end_time: 2025-06-30就能把范围卡死再把comments.enabled打开每条作品旁边会多出一个*_comments.json设include_replies: true还能抓二级回复做互动分析时省得回网页上翻。不习惯命令行的话前面提到的桌面版有个可视任务中心任务结果、失败项一键重试、输出目录直接打开都在这里。为什么值得留在工具箱里我实际跑下来真正加分的是下面三点。双重去重加增量下载像图书馆的借阅记录工具留了两套账一套在 SQLite 数据库里一套在磁盘文件名里。同一个任务跑第二遍每条作品都要过这两道检查已入库的跳过只把新的上架所以误触重跑也不会下出一堆重复文件。限速和重试像快递公司的重派机制单次请求失败会按 1s、2s、5s 指数退避重试retry_times默认 3 次同时工具自我约束在默认 2 请求/秒不把火力打满避免触发对面风控导致整批任务报废。下载完成还会用 Content-Length 比对文件大小不完整的自动清理重试。浏览器兜底是我见过比较实用的设计。API 翻页被风控的典型症状是只能抓到 20 条这时工具会自动开一个浏览器滚动抓取遇到验证码就弹窗headless: false让你人工滑一下然后继续干活——机器卡住的地方人补一刀。调一调变成你的下载策略常用配置都集中在 config.yml 里下面这组是改动最频繁的选项link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx mode: - post number: post: 50 start_time: 2025-01-01 thread: 5关键选项说明mode— post 作品 / like 点赞 / mix 合集 / music 音乐collect、collectmix是本人账号收藏夹专用且必须单独使用number.*— 各模式的数量上限0表示不限start_time/end_time— 按作品发布时间过滤格式YYYY-MM-DDvideo_quality— original 原画 / highest 最高转码档默认/ lowest / 指定 1080p 等分辨率music、cover、avatar、json— 附带产物开关默认全关只存视频本体省磁盘filename_template— 文件与目录命名模板可用{date}、{title}、{id}等变量模板里必须带{id}防止重名覆盖⚠️ 翻车了怎么办只抓到 20 条作品后面没有了这是翻页风控的典型信号。确认browser_fallback.enabled: true且headless: false浏览器窗口弹出后手动完成验证别急着关。Cookie 失效、下载报错重新执行python -m tools.cookie_fetcher --config config.yml即可一条命令的事。想重新下载某条作品为什么不动去重判断是数据库记录 本地文件双重检查重新下载需要两边都清删掉Downloaded/下对应目录再用 sqlite3 把dy_downloader.db里的记录删掉。反过来只删文件数据库仍有记录就会触发重新下载只删数据库记录则不会。进度条刷屏日志默认progress.quiet_logs: true已在进度阶段静默调试时临时加-v看完整日志。下下来的文件播放不了先确认文件大小是否正常再检查网络或代理是否稳定thread调低一点重跑通常也能解决。使用前的几条规矩版权只下载你有权使用的内容别碰侵犯他人版权、隐私的东西平台条款个人存档用途问题不大二次发布、商用分发请自行判断责任在你请求频率默认 2 请求/秒、重试 3 次是经过权衡的稳定组合别为了快把线程数和频率往上硬堆IP 被临时限制反而整批白跑定位项目声明用于技术研究、学习交流与个人数据管理平台接口策略变动导致功能失效属于正常技术风险写在最后douyin-downloader 把从单条无水印到整页存档的路都铺好了去重、重试、限速、浏览器兜底、通知推送一应俱全MIT 协议免费使用。遇到问题或想要新功能欢迎去项目仓库提 Issue、发 PR把它变成你真正顺手的那套内容管理流程。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表