ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

抖音视频批量下载入门:douyin-downloader 一步到位的完整指南

抖音视频批量下载入门:douyin-downloader 一步到位的完整指南 抖音视频批量下载入门douyin-downloader 一步到位的完整指南【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader把抖音视频一条条手动存到本地水印去不掉、操作又繁琐douyin-downloader 就是一个为抖音视频批量下载而生的开源命令行工具去水印、批量抓取、直播录制都能交给它完成。本文带你走完四步跑通第一次下载 → 配置登录态 → 圈定下载范围 → 把长任务跑得稳。先对一下号你有没有这些情况动手装工具之前先看下面这些场景你中招了几条收藏攒了几百条逐条打开、另存存到一半就放弃了用第三方站点下过视频结果全是水印或者一堆广告想存的不只是视频——图集、合集、背景音乐、直播回放也想留一份同一批内容反复下过磁盘里躺着一堆重复工件批量任务一跑几十分钟中途挂了也完全没察觉只要勾中两条以上这个工具就是为你准备的链接识别、去水印下载、自动归档、断点续传、失败重试整条链路它都管了你只负责给链接和一份配置。快速上手三步下载第一条视频第一步把项目克隆到本地git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader第二步装好 Python 依赖需要 Python 3.8 以上pip install -r requirements.txt如果你后面想用自动弹浏览器登录取 Cookie的能力顺手再装一个 Playwrightpip install playwright python -m playwright install chromium第三步建一份最小配置然后运行。项目自带模板拷一份出来用cp config.example.yml config.yml打开config.yml把link换成单个视频链接来测试这样最稳妥能快速验证 Cookie 和网络都正常别一上来就丢一个用户主页link: - https://www.douyin.com/video/1234567890123456789 path: ./Downloaded/然后执行python DouYinCommand.py程序会先打印本次下载配置接着逐条推进度条最后给出下载完成成功 N/N的统计。已经下过的文件会直接标跳过已存在全程不用你干预。看到最后那条成功统计你的第一条无水印视频就到手了。跑通之后看清它到底能干什么第一次跑通只是开胃菜。下面是这个工具的能力速查一次看全项目内容覆盖的内容类型视频、图文图集、合集、音乐原声、直播、直播回放批量能力按用户主页整包抓取作品、点赞、合集、音乐可多模式叠加附带资源封面图、作者头像、JSON 元数据、背景音乐可逐项开关稳定性机制失败自动重试、SQLite 数据库去重、浏览器兜底接管使用形态命令行脚本 桌面客户端 Douzy两种形态本地免费用它支持的链接类型也很直白一一对应不同内容链接形态对应内容https://www.douyin.com/video/xxxx单条视频https://www.douyin.com/note/xxxx单条图文笔记https://www.douyin.com/collection/xxxx单个合集https://www.douyin.com/music/xxxx单条音乐原声https://www.douyin.com/user/xxxx用户主页可批量抓https://live.douyin.com/xxxx直播间可实时录制https://webcast.amemv.com/reflow/xxxx直播回放单条视频、图集、合集这类链接工具会自动识别类型你不需要额外指定模式。批量抓取多条内容时进度条会像下面这样逐条推进到 100%登录态动手前必须做的一件事抖音的大部分内容都要登录才能看所以 Cookie 配不好后面全是白干。项目给了三条路选一条就行自动获取推荐python cookie_extractor.py工具会弹浏览器引导你完成登录然后自动把 Cookie 写好手动粘贴浏览器登录抖音后从开发者工具里复制整串 Cookie填进配置文件的cookies字段浏览器兜底程序内置浏览器模式接口受限时会自动接管请求你只需要完成一次页面验证。自动获取的详细步骤可以参考项目自带的 使用说明 一节。记住一点Cookie 有有效期。哪天突然大面积下载失败第一个怀疑对象就是它过期了重跑一遍自动获取流程基本就能恢复。圈定下载范围内容与数量同样是用户主页链接mode填得不同抓回来的东西完全不同——这是配置里最核心的开关mode 取值抓取的内容post该用户发布的作品like该用户点赞过的作品mix该用户创建的合集music该用户相关的音乐原声模式可以叠加比如post music就是作品和原声一起拿。数量上限和时间范围也能精确卡住配置项写法说明number每个模式一个数字0表示不限例如post: 50只抓最近 50 条start_time/end_timeYYYY-MM-DD只抓这个日期区间内发布的内容increase每个模式一个布尔值增量模式只下载新出现的配置项全览一张表调完所有参数常用参数就下面这些对着改就行参数作用建议值link要下载的链接列表可多条按需填写path文件保存根目录自定义一个目录mode主页链接的下载模式组合从post起步number各模式的数量上限0 不限制thread并发线程数默认 5网速好可加到 8retry_times单条失败后的重试次数3 左右max_per_second每秒最大请求数压风控用的2~3music/cover/avatar是否顺带下音频、封面、头像truejson是否保存元数据 JSONtruedatabase是否启用数据库去重truestart_time/end_time按发布时间过滤留空不过滤proxyHTTP/HTTPS 代理地址按网络环境填database: true值得单独说一句每条下载记录都会写进 SQLite 数据库再和本地文件双重比对下次运行自动跳过已存在的作品——这就是它能长期增量跑而不重复占磁盘的原因。文件落在哪、名字怎么定默认归档结构是创作者 → 模式 → 日期_标题_ID层级清楚找东西不费劲Downloaded/ └── user_某位作者/ └── post/ └── 2024-12-30_作品标题_aweme_id/ ├── video.mp4 # 无水印视频 ├── music.mp3 # 背景音乐 ├── cover.jpg # 封面 ├── avatar.jpg # 作者头像 └── metadata.json # 完整元数据下载完成后的目录效果大致是这样每条作品一个独立文件夹对命名有洁癖的话用模板变量自定义文件夹名filename_template: {date}_{title}_{id}可用变量一行说清{date}发布日期、{title}标题、{id}作品 ID、{author}作者昵称、{author_id}作者 ID、{mode}下载模式随便组合。四套用即走的场景配方配方一整站备份一个创作者场景把某个博主的作品全集打包收入本地。一个主页链接 多模式 数量不封顶link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx mode: - post - mix - music number: post: 0 mix: 0 music: 0配方二直播实时录制场景整场直播想完整留档不用开录屏软件。直接用命令行参数指向直播间python DouYinCommand.py -l https://live.douyin.com/123456789 -p ./Downloaded/程序会拉出该直播间的全部清晰度输入编号后把流地址打到终端配合max_duration_seconds最长录制时长0 表示录到下播和idle_timeout_seconds空闲超时自动结束两个参数长直播也能安心挂着配方三评论数据采集场景做内容分析想把作品下的评论也一并收走comments: enabled: true include_replies: false # 是否包含二级回复 max_comments: 500 # 采集上限 page_size: 20配方四每天只补新增场景定时任务每天跑一遍只拿新内容。开数据库去重 增量模式increase: post: true like: true database: true旧作品全部自动跳过硬盘只增不重。让长任务不翻车批量任务跑得久最怕中途崩掉白跑一趟。下面这一组参数是防翻车组合拳一次配好thread: 8 # 网好可以适度调高并发 retry_times: 3 # 单条失败自动重试 max_per_second: 2 # 控住请求频率压风控概率 proxy: http://127.0.0.1:7890 # 需要代理时填 browser_fallback: enabled: true # API 受限时切浏览器兜底 headless: false max_scrolls: 240 idle_rounds: 8 wait_timeout_seconds: 600翻到后面几页触发风控时浏览器兜底会弹出一个真实浏览器窗口你手动过一次验证任务就接着跑。任务结束后还可以把结果推到手机跑批量的时候不用盯终端notifications: enabled: true on_success: true on_failure: true providers: - type: bark url: https://api.day.app/YOUR_DEVICE_KEY不想敲命令用桌面版 Douzy命令行适合脚本化定时跑但日常零散下载更顺手的是桌面客户端 Douzy同样是本地免费使用。它把四件事都做成了可视化链接自动识别粘贴主页或单条链接自动检测内容类型勾选作品 / 喜欢 / 合集就能开下任务中心统一调度所有任务集中管理进行中、成功、失败一目了然支持一键打开目录作品档案检索历史下载记录进本地数据库后可按博主、关键词、类型、时间范围多维筛选还能一键下载最新作品实时事件流每个任务从解析链接、排队到处理完成每一步状态都有日志卡在哪一步一看便知。每条作品的下载明细视频、头像、音乐、封面、元数据齐不齐在任务详情里也能逐件核对出问题就查这里为什么批量下载只拿到 20 条左右就停了这是抖音的翻页限制在拦你。把browser_fallback打开弹窗时手动过一次验证就能继续往下抓。怎么某天突然全部下不动了最大嫌疑是 Cookie 过期。它是有寿命的重新跑一次python cookie_extractor.py一般立刻恢复。想翻一下之前都下过什么直接查数据库最快sqlite3 data.db SELECT aweme_id, title, author_name, datetime(download_time, unixepoch, localtime) FROM aweme ORDER BY download_time DESC LIMIT 20;某条作品想重新下载一遍怎么办数据库记录和本地文件两边都要清缺一边都不行sqlite3 data.db DELETE FROM aweme WHERE aweme_id 作品ID;再删掉对应目录重新运行即可。下载速度太慢怎么提速按顺序试三件事加thread并发、放宽max_per_second、必要时挂代理。注意小步慢加一步拉满容易触发风控反而更慢。收尾一句话定位douyin-downloader 就是把保存抖音内容这件琐事做成了一条命令的自动化流水线——链接 配置剩下的交给它。给你三条马上能用的建议先用单条视频链接把 Cookie 和网络验证掉再放大到批量任务给不同用途各建一份配置文件比如日常收藏和完整备份分开维护Cookie 定期重新获取一次这是长期稳定跑的生命线。声明本项目仅供技术学习与个人数据管理使用请遵守平台规则尊重创作者版权与内容权益。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表