尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

5 分钟落盘 100 个视频链接:you-get 批量下载命令行工具上手指南

5 分钟落盘 100 个视频链接:you-get 批量下载命令行工具上手指南 5 分钟落盘 100 个视频链接you-get 批量下载命令行工具上手指南【免费下载链接】you-get:arrow_double_down: Dumb downloader that scrapes the web项目地址: https://gitcode.com/GitHub_Trending/yo/you-get手头攒了一百多个课程链接一条一条复制进浏览器的下载框手酸半天还总有漏网的。you-get 就是干这个的一个不依赖浏览器、也不跑广告插件的轻量命令行下载工具从网页抓取视频、音频和图片而它的批量下载功能能把清单文件里的 URL 一次处理完。读完这篇这类重复劳动只要 5 分钟你还会顺带知道新手最容易踩的三个坑。 三步跑通第一步安装。一条 pip 命令就能用需要 Python 3.7.4 及以上版本另建议装好 FFmpeg想跟最新开发版把源码 clone 下来在目录里执行 pip install . 即可。# 用 pip 安装 you-get pip install you-get第二步写清单文件。新建一个纯文本文件 urls.txt一行贴一个链接不加多余符号。在 Windows 上打开 PowerShell 或 cmd后续命令同样适用。https://www.example.com/ep01.html https://www.example.com/ep02.html https://www.example.com/ep03.html第三步执行一条命令。让 you-get 读入清单并保存到你指定的目录它会按文件顺序逐个下载终端里每个链接都会打出进度条。# 从文件读入链接保存到当前目录下的 videos 文件夹 you-get --input-file urls.txt -o ./videos上面三步走完最基本的批量下载就跑通了。接下来看那些让你能控制保存位置、同名处理和超时的参数。 常用批量下载参数不用背全参数表下面七条就能覆盖大部分批量下载场景大白话一列直接告诉你它在干什么参数作用大白话-I从文本文件读入 URL按这份清单下载-o指定保存目录文件都放进这个文件夹-f强制覆盖已有文件同名先删掉再下-a自动重命名重名就自动加个编号错开--pre给文件名加前缀整批文件统一冠名-t设置 socket 超时秒等多久才判定失败-x走 HTTP 代理借个中转服务器连网完整参数表可以在 src/you_get/common.py 里找到每个参数都是在那里用 argparse 注册的支持站点数百个各站点的解析逻辑按文件分开放在 src/you_get/extractors/想确认某个网站是否支持直接看那个目录里有没有对应文件即可。 案例把 40 集系列视频整批落盘帮朋友把《Python 入门》系列 40 集存到本地。他把 40 条链接一行一条贴进 urls.txt然后跑# 整份清单下载统一加 py101- 前缀存入课程专用目录 you-get --input-file urls.txt --pre py101- -o ~/courses/python-intro执行时每个视频先打印站点、标题、大小随后是下载进度条单集结束自动接下一集。40 集全部跑完~/courses/python-intro 目录里的 mp4 都带 py101- 前缀字幕 srt 文件也落在同一位置。过程不用盯着起身冲杯咖啡回来已经跑了一半验收很直接——数目录里的文件是不是 40 个就行。前缀的好处是以后混进别的课程文件也能一眼区分。⏱️ 实际能省多少手动操作和批量下载的差距会随链接数量越拉越大规模手动逐条粘贴you-get 批量缩减幅度10 条约 5 分钟约 1 分钟80%40 条约 25 分钟约 2 分钟92%100 条约 60 分钟约 5 分钟92%以上按家庭宽带环境估算。手动操作有固定开销切浏览器、粘贴、等下载启动、再切出去这部分开销不随数量减少而命令行批量每多一条链接只多跑一次解析清单越长省下的比例越稳定。️ 新手最常踩的三个坑第一行乱码、链接无效—— 清单文件被存成了 GBK 编码读进来时中文变乱码整行被当成无效地址。解法按 UTF-8 重新保存实在挑不好编辑器编码就只留纯链接、删掉注释这个坑自然消失。同名文件不更新—— you-get 默认跳过已存在且大小相同的文件防止重复下载副作用是原片重新剪辑后也不会重拉。解法加-f强制覆盖要下的是恰好同名的不同内容就加-a自动重命名错开。网速慢直接超时—— 单条视频的下载时间超过超时上限工具判定 socket 超时后中止。解法用-t 1200把超时拉长单位是秒或换个快一点的网重跑。另外-I文件不支持播放列表和-l同时用会直接报错退出清单里请放直链地址别放播放列表页。收尾需要存几十上百条链接时you-get 的批量下载能把一下午的复制粘贴压成一次 5 分钟的等待。先拿手边 10 条链接试跑一遍碰到解析不了的站点就去仓库提一个 Issue这是推动支持覆盖最快的方式。【免费下载链接】you-get:arrow_double_down: Dumb downloader that scrapes the web项目地址: https://gitcode.com/GitHub_Trending/yo/you-get创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表