当前位置: 首页 > news >正文

douyin-downloader 完整上手教程:开源免费,把抖音视频与直播回放批量存进本地硬盘

douyin-downloader 完整上手教程:开源免费,把抖音视频与直播回放批量存进本地硬盘

【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader

小周追的那场直播课,讲到一半她走神了,等回过神,直播间已经黑屏。回放要会员,而且只保留七天。她跟同事老李抱怨,老李丢过来一个项目名:douyin-downloader。当晚小周装好工具,把后面几场直播原画质录进硬盘,顺手把讲师主页上四十多条历史作品一次性搬空。douyin-downloader 是一个免费开源、跨平台的抖音下载工具,支持视频、图集、合集、音乐与用户主页批量下载,还能录制直播回放,自带去水印、进度展示、失败重试和数据库去重,适合想给自己建一座个人内容库的人。

从"手动一个个存"到"一条命令搬空",差的不是手速

场景没有它时有了它之后
直播内容播完即走,回放要会员还要赶在七天内看完边播边录,主播下播自动保留已录数据
作者主页翻页翻到手指酸,一次还只能看到二十条一条配置批量拉取,作品、点赞、合集、音乐全收
文件管理一堆"视频(1).mp4"挤在同一个文件夹按作者、按类型、按日期自动建目录
重复下载存了又存,硬盘悄悄变满数据库加本地文件双重去重,重复的自动跳过
追更新每天手动刷新看有没有新作品增量模式只下新增内容,定期跑一遍就同步

三条命令,先把"下载引擎"装进电脑

不用折腾服务器,一台装了 Python 3.8+ 的电脑就能跑。把项目拉下来,装好依赖:

git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt

第一次使用要先解决登录态。复制一份配置文件,再运行自动获取 Cookie 的命令——它会自己打开浏览器,你扫码登录后回到终端按回车,Cookie 就自动写进配置:

cp config.example.yml config.yml python -m tools.cookie_fetcher --config config.yml

最后把想下载的链接填进config.yml,运行python run.py -c config.yml,剩下的交给进度条。命令行跑起来的样子:

之后想临时加链接、改路径、调并发,都不用动配置文件,直接在命令后面追加-u-p-t这类参数。如果你更习惯点鼠标,还有一个基于同一套后端的桌面版 Douzy,粘贴链接、同步关注列表、任务中心都是图形化操作:

你想做的事不一样,配的选项也不一样

直播回放怎么存?开一个录制任务就行

把直播链接丢进去,配好时长上限和空闲判定,就能一边看一边录。录完的 FLV 会落到Downloaded/作者名/live/目录,还附带一份直播间元数据快照。哪怕主播中途下播、网络断了、或者你按了 Ctrl+C,已经录下来的部分也会被保留,不会白录。

link: - https://live.douyin.com/123456789 live: max_duration_seconds: 3600 # 0 表示一直录到主播下播 chunk_size: 65536 idle_timeout_seconds: 30

怎么把一位作者的主页一次搬空?

发现一个宝藏博主,想把 TA 的全部作品存下来?把主页链接填进link,再用mode声明要哪些内容:post是发布的作品,like是点赞的,mix是合集,music是音乐。number控制数量,填 0 就是全量抓取。同一个作品在不同模式下会自动去重,不会重复占硬盘。

link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx mode: - post - like - mix - music number: post: 50 like: 0

工具默认 5 个线程并发下载,失败自动重试,配了代理也能正常走。批量任务跑起来,进度条一路刷到 100%,非常解压:

下载的文件怎么自动整理?

很多人的下载目录是"大杂烩",这个工具默认按「作者 → 类型 → 单条作品」三层结构归档,每部作品一个文件夹,里面放着视频、封面、音乐、元数据 JSON 和作者头像。文件夹名默认带日期和标题,一眼就能认出是谁的哪条内容:

Downloaded/ └── 作者名/ ├── post/2024-02-07_作品标题_aweme_id/ ├── like/... ├── mix/... └── music/...

怎么只下载新增内容,不重复搬运?

追更最怕"每次全量重下"。打开增量开关,工具会拿数据库记录和本地文件做双重比对,只处理没下载过的新作品。再配合时间过滤(start_time/end_time),还能只拉某个时间段的内容,适合定期同步。

increase: post: true like: true mix: true music: true database: true

想顺带把评论区也存下来?

对某个作品下的讨论感兴趣?开启评论采集后,每个作品旁边会多生成一份*_comments.json,评论、二级回复都能抓,max_comments: 0就是不设上限。

comments: enabled: true include_replies: false max_comments: 0 page_size: 20

进阶玩法:把工具调成你自己的形状

文件名想按自己的习惯来

不喜欢默认命名?filename_templatefolder_template可以自定义,日期、标题、ID 都是可用变量,比如{date}_{title}_{id}。桌面版里还有可视化模板编辑,勾一勾就能预览最终效果,不懂代码也能配。

下完了想收到通知

下载完成想让手机响一声,避免干等。支持 Bark、Telegram 和通用 Webhook,企业微信、飞书、钉钉的机器人地址也能填,成功失败都能推,单个渠道失败不会卡住主流程。

notifications: enabled: true on_success: true providers: - type: bark url: https://api.day.app/YOUR_DEVICE_KEY

想让别的程序也能发起下载

工具能以 REST API 服务模式运行:python run.py --serve --serve-port 8000,之后就能用 HTTP 提交下载任务、查询任务状态。想把它接进自己的网页、脚本或自动化流程,这条路已经铺好。

搜热搜、搜关键词、给视频转文字

--hot-board 30拉热搜榜快照,--search "关键词"按关键词搜作品,结果都以 JSONL 落盘,方便后续分析。还藏了一个转写功能:开启后视频会自动调用语音识别接口,输出 txt 和 json 两种文稿,做内容检索或字幕参考都行。

五个常见问题,用大白话先答一遍

问:为什么一次只能抓到 20 条?答:这是抖音翻页风控的常规现象,不是你配置错了。把浏览器兜底打开(browser_fallback.enabled: true),让它弹出浏览器,手动过一下验证码再继续,就能往下翻。

问:Cookie 失效了怎么办?答:重新跑一次python -m tools.cookie_fetcher --config config.yml,扫码登录完按回车,自动写回配置,不用去开发者工具里翻字符串。

问:怎么看下载历史?答:所有记录都存在 SQLite 里,一条命令就能查最近下载的作品、作者和时间:sqlite3 dy_downloader.db "SELECT aweme_id, title, author_name FROM aweme ORDER BY download_time DESC LIMIT 20;"

问:下了个半截文件,会不会留个坏文件在硬盘里?答:下载时会比对文件大小,不完整的文件会被清理并自动重试,不会拿残缺文件冒充成品。

问:文件不小心删了,还能重新下吗?答:可以。程序同时参考数据库记录和本地文件判断,删了文件但记录还在,会视为需要重新下载;想彻底重下,把对应记录从库里删掉即可。

省着点用,也守好边界

工具好用,但别"暴力使用"。短时间内大量请求容易触发平台风控,建议分批下载、控制并发,网络状况好的时段再跑大批量任务,成功率更高。存储上,定期清理低质量内容,重要资料及时备份,别让硬盘悄悄被塞满。

还要把话说明白:下载的内容请只用于个人学习与研究,尊重创作者版权,遵守平台规则。工具本身仅作技术用途,任何违规操作都不该与它沾边。这是每个使用者都应该守住的底线。

现在就可以动手了

打开终端,把项目克隆到本地,填一个你最想保存的链接,跑一次run.py。亲眼看着进度条一格一格走完,文件自动落进分类好的文件夹时,你会觉得:原来整理自己的内容库,可以这么省心。

详细的配置项说明都在config.example.yml,完整使用指南见USAGE.md,想研究实现原理可以翻core/目录,桌面版 Douzy 的界面截图在douyin-downloader/img/desktop/下,可以按图索骥。祝你的硬盘,装得下所有想留住的精彩内容。

【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

http://www.cnnetsun.cn/news/4043509.html

相关文章:

  • OpCore-Simplify 快速上手指南:一条命令把黑苹果 OpenCore EFI 配置从数小时压缩到几分钟
  • 图片上传与存储实战:AWS S3在instagram-mern项目中的应用指南
  • IP-Adapter 快速上手指南:22M 参数的图像提示适配器如何驱动扩散模型
  • 免费开源的ERPNext实战记:小公司的账、货、订单,真的能被它管成一条线
  • RAT-retrieval-augmented-thinking进阶技巧:如何优化推理过程提升回答质量
  • 微信防撤回终极指南:3分钟用RevokeMsgPatcher告别消息被撤回
  • Win11Debloat 免费优化指南:一个脚本如何扫清 Windows 11 的卡顿、广告与隐私隐患?
  • boolinq:革命性C++11单文件LINQ库,让STL容器操作效率提升10倍
  • OWASP Top 10核心漏洞解析:从原理到实战的Web安全防御指南
  • AlphaGenome API密钥获取与安全使用完整指南:3步拿到钥匙并跑通第一次预测
  • Rhino 3D 建模从零到精通:完整学习路线与 5 个效率翻倍的实用技巧
  • 免费Java字节码编辑器 Recaf 实战:无源码JAR包,从看懂到改通只要5分钟
  • 如何快速上手VPKEdit:游戏资源打包与解包工具的完整指南
  • Windows驱动清理工具DriverStoreExplorer上手:十分钟从C盘挖回几十个GB空间
  • 企业微信推送配置:mimotion刷步结果实时通知教程
  • 零基础 30 分钟跑通:MediaCrawler 多平台数据采集完整上手指南
  • Minecraft存档修复终极指南:7种区块暗病对症下药,快速拯救濒危存档
  • 告别反复重装系统:这款开源的Windows系统优化工具箱WinUtil,为何值得每个装机党收藏
  • 微信聊天记录如何永久保存?WeChatMsg导出工具保姆级实测指南
  • MediaCrawler 快速上手指南:一套配置搞定五大平台社交媒体数据采集
  • Krokiet重复文件清理教程:7个实用技巧让你的硬盘重获新生
  • PDF补丁丁实战教程:4个真实场景一次讲透书签编辑、页面处理与图片提取
  • MediaCrawler爬虫框架实战手册:5步跑通小红书、抖音、B站、快手、微博的数据采集
  • 转换视频一定要几小时?m4s-converter 用 5 秒证明:你可能一直在做多余的事
  • PyCharm虚拟环境与包管理全攻略:从pip安装到项目依赖管理
  • IntelliJ IDEA 2018.3 本地授权服务器部署与激活原理深度解析
  • GEO搜索优化科普:正规地域流量分发与内容运营指南
  • Jane Street OCaml Workshop项目架构解析:从dune配置到模块设计最佳实践
  • RabbitMQ 全套复盘 + Nacos+ES+MyBatis-Plus 梳理
  • 下载老是断、速度上不去?3步把浏览器下载交给Motrix,多线程续传全搞定