尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

三步跑通 douyin-downloader:免费开源的抖音视频批量下载工具,从单条到整个主页一次讲透

三步跑通 douyin-downloader:免费开源的抖音视频批量下载工具,从单条到整个主页一次讲透 三步跑通 douyin-downloader免费开源的抖音视频批量下载工具从单条到整个主页一次讲透【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader刷到一条绝佳的抖音视频想存下来慢慢看却只能截图追着一个宝藏博主想把 TA 发的几十条作品全部备份却要一条条手动操作更别提那些辛苦剪辑的视频一保存就带上平台水印画质还被压得没法看。你是不是也在这类想收藏却无从下手的时刻反复抓狂过如果你点头了那今天要聊的 douyin-downloader 大概率能帮你一次性解决这些烦恼。它是一款完全免费的 Python 开源工具专攻抖音视频批量下载与无水印高清保存把单个视频、图文、合集、原声音乐、作者主页、直播回放统统装进一个命令行里。你只需要给它一个链接剩下的翻页、去重、命名、整理它都会替你打点好。动手之前先认识一下这个工具能替你扛下哪些脏活累活与其堆一堆形容词不如直接看它内置的几个真本事每一个都对应一个你大概率遇到过的痛点无水印优先 自动挑最高清工具会优先抓取无水印的视频源并基于码率数组自动选择画质最高的那一路省去你手动对比的功夫。断点续传与自动重试下载中断不用从头再来程序按 1 秒、2 秒、5 秒的节奏指数退避重试下载完还会比对文件大小缺斤少两的文件会被自动清理重下。SQLite 数据库去重同一个作品无论被 post、like、mix 哪个模式碰到都只下载一次。配合本地文件双重检查重复下载基本与你无缘。浏览器兜底当 API 翻页被平台风控卡住比如只抓到 20 条时工具会自动拉起浏览器补数据弹窗验证码你手动点一下就能继续不会卡死在半路。这四条构成了整个工具的地基。地基稳了我们再来盖房子——先跑通一次最小流程看看效果。三分钟搭好环境装依赖、写配置、拿 Cookie工具要求 Python 3.8 及以上macOS、Linux、Windows 都支持。先把项目代码拿到本地# 拉取项目源码 git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader # 进入项目目录 cd douyin-downloader # 安装全部依赖aiohttp、rich、pyyaml 等都在里面 pip install -r requirements.txt装完依赖后复制一份配置模板# 生成你自己的配置文件 cp config.example.yml config.yml接下来是最关键的一步配置 Cookie。抖音的接口需要登录凭证没有它工具就寸步难行。好在项目提供了自动获取的方式# 自动打开浏览器完成登录回车后自动写回配置 python -m tools.cookie_fetcher --config config.yml命令执行后会弹出浏览器你正常登录一次抖音回到终端按回车Cookie 就自动写进配置文件了。整个过程大概一两分钟之后短时间内都不用再碰它。小提示如果你希望遇到翻页风控时能启动浏览器兜底建议顺手装一下 Playwrightpip install playwright后再执行python -m playwright install chromium装好就能用。一条命令跑通你的第一个视频下载环境就绪现在来点实实在在的。先拿单个视频开刀命令拆开看每部分都干什么python run.py \ -c config.yml \ # 指定配置文件内含 Cookie 与下载选项 -u https://www.douyin.com/video/7604129988555574538 \ # 追加要下载的视频链接 -t 8 \ # 并发线程数默认 5网络好可调大 -p ./Downloaded # 保存到当前目录下的 Downloaded 文件夹运行后你会看到一个带进度条的实时界面正在解析链接、正在拉取作品数据、正在下载媒体文件……每一步都有明确的状态反馈。下载完成后去Downloaded/目录里翻一翻视频文件、封面图、原声音乐、JSON 元数据已经整整齐齐躺在对应的文件夹里了。小提示命令行里也能临时改并发数比如-t 8。但如果你只是想快速下载一条直接python run.py -c config.yml -u 你的链接就够了其余都走配置默认值。批量搬空一个创作者的主页post、like、mix 全都要单条下载只是开胃菜这个工具真正让人上头的是把整个作者主页端走的能力。打开你的配置文件填上作者主页链接和想要的模式# 要下载的作者主页链接 link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx # 下载模式post 是发布作品like 是点赞作品 mode: - post - like # 各模式的数量限制0 表示全量下载 number: post: 50 # 最近 50 个作品 like: 0 # 点赞过的全部下载 # 并发与重试 thread: 5 retry_times: 3保存后运行python run.py -c config.yml你就能看到下面这样的批量下载进度画面每个任务独立显示状态和耗时如果你只是偶尔想下载几条新作品更轻量的方式是命令行直接追加参数不必改配置# 只下载该博主最新发布的 10 条 python run.py -c config.yml -u https://www.douyin.com/user/MS4wLjABAAAAxxxx再叠加一个很实用的增量模式打开配置文件把increase.post设为true工具会借助数据库记住哪些已下载下次运行只拉新增内容。追更博主、日常备份全靠这一招省流量省时间。图文、合集、原声音乐不止视频一套命令全收下很多人的需求并不止于视频。douyin-downloader 对这些内容同样是一键搞定只要把链接换成对应类型即可你想下载的东西放什么链接说明单条图文/note/xxxx或/gallery/xxxx图文按图片集方式保存单个合集/collection/xxxx或/mix/xxxx一次性拿下整个合集单首音乐/music/xxxx优先抓原声文件缺失时自动回退到该音乐下的首条作品收藏夹内容当前账号的收藏页链接用collect/collectmix模式单独执行组合使用也很自由比如在配置里同时写mode: - post - like - mix - music工具会跨模式自动去重同一个作品绝不会被下载两遍。收藏夹模式要单独用不能和 post、like 混在同一批次里这点留意一下就行。小提示number里填 0 就是不限制、全量抓取。但首次大规模下载时建议先设个小数字试跑确认链接和 Cookie 都没问题再放开避免白等半天。下载到本地的文件会被安排得明明白白下载只是第一步整理才是长期痛点。这个工具默认把文件组织成下面这种结构一眼就能看懂Downloaded/ ├── 作者名/ │ ├── post/ │ │ └── 2024-02-07_作品标题_aweme_id/ │ │ ├── ...mp4 # 视频本体 │ │ ├── ..._cover.jpg # 封面图 │ │ ├── ..._music.mp3 # 原声音乐 │ │ └── ..._data.json # 元数据 │ ├── like/ │ └── mix/ └── download_manifest.jsonl # 全量下载清单一行一条记录文件与目录名默认采用日期_标题_作品ID模板还可以通过filename_template和folder_template自定义。日期用的是作品发布时间而非下载时间这样归档后按时间排序就非常自然。想按时间段筛选在配置里写# 只下载这个时间段内的作品 start_time: 2024-01-01 end_time: 2024-12-31每个作品文件夹里附带的_data.json保存了完整的原始元数据以后想检索、想统计、想做二次整理都有据可查。加上 SQLite 数据库dy_downloader.db里的历史记录你的本地抖音资料库就有了雏形。小提示想要重新下载某个作品需要删文件 删数据库记录两步走。只删数据库不删文件工具会扫描本地文件名去重依然跳过只删文件不删数据库才会触发重新下载。进阶玩法直播录制、热搜榜、关键词搜索与完成通知如果前面这些还不过瘾工具还藏了几手大活建议按需解锁录直播把链接指向live.douyin.com/{房间号}在配置的live段设置录制时长0 表示录到主播下播。主播下播或网络中断时已经录好的字节会被保留FLV 文件直接可播放不会白录一场。link: - https://live.douyin.com/123456789 live: max_duration_seconds: 3600 # 0 一直录到下播 idle_timeout_seconds: 30抓热搜、搜关键词这两招适合做内容调研结果会导出成 JSONL 文件方便后续分析# 导出当天热搜前 30 条 python run.py --hot-board 30 -p ./Downloaded # 按关键词搜索作品最多 100 条 python run.py --search 猫咪 --search-max 100 -p ./Downloaded下载完推个通知在配置的notifications段填上 Bark、Telegram 或企业微信 webhook 地址批量任务跑完手机上立刻收到结果不用一直盯着终端。开成 REST API 服务想把它嵌进自己的脚本或网页装好fastapi和uvicorn后运行python run.py --serve --serve-port 8000就能用 HTTP 接口提交下载任务、查询任务状态了。踩坑自检手册四个高频问题一次讲透实际使用中绝大多数困扰都集中在下面四个问题上。按现象 → 原因 → 解决的顺序对号入座即可问题一明明有几百个作品只抓到 20 条就停了。这是 API 翻页被风控的典型表现。原因在于接口分页受限。解决确认配置里browser_fallback.enabled: true、headless: false触发浏览器兜底后手动完成验证码别急着关窗口等它自己拉完。问题二跑着跑着提示登录态失效下载中断。原因Cookie 过期抖音把你踢出来了。解决重新执行python -m tools.cookie_fetcher --config config.yml重新登录一次即可恢复。问题三终端里日志刷屏进度条看不清。原因默认打开了调试级别的信息输出。解决把配置里progress.quiet_logs设为true静默进度日志只有排查问题时才临时加-v或--show-warnings。问题四想重新下载之前的内容但它总是被跳过。原因数据库记录和本地文件双重去重生效了。解决按前面的说明同时清理本地文件与dy_downloader.db里的对应记录。常用命令速查表建议收藏目的命令说明下载单个视频python run.py -c config.yml -u 视频链接最基础的一键下载下载单个图文配置里放/note/xxx链接图文按图片集保存批量下载主页作品配置mode: [post]number.post0 表示全量只下新增内容配置increase.post: true依赖数据库记录按时间筛选配置start_time/end_time格式YYYY-MM-DD录制直播配置live段 直播间链接FLV 直接可播抓热搜榜python run.py --hot-board 30导出 JSONL关键词搜索python run.py --search 关键词结果落 JSONL查看下载历史sqlite3 dy_downloader.db SELECT * FROM aweme LIMIT 20;直接用 SQL 查自动刷新 Cookiepython -m tools.cookie_fetcher --config config.yml登录态失效时用写在最后用得开心也要用得合规douyin-downloader 的设计初衷是帮你管理自己的内容、备份喜欢的作品、做技术研究请尊重创作者的版权与平台的规则只把下载的内容用于个人学习、研究或备份不要二次传播或商用平台接口策略变更导致功能暂时失效也属于正常的技术风险。给你的两个具体建议第一步先拿自己的账号、自己的作品试跑一遍全流程把配置和命名习惯调顺第二步开启increase增量模式把定期备份关注博主变成日常习惯。从今天这一条命令开始你的抖音内容管理效率会提升一大截祝玩得顺手。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表