ARTICLE DETAIL

资讯详情

深耕编程入门与网站建设的一线实战洞察。

douyin-downloader:抖音批量下载工具,1 个配置文件覆盖 7 类内容

douyin-downloader:抖音批量下载工具,1 个配置文件覆盖 7 类内容 douyin-downloader抖音批量下载工具1 个配置文件覆盖 7 类内容【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloaderdouyin-downloader 是一个用 Python 编写的抖音批量下载工具单个视频、图文、合集、音乐、作者主页、收藏夹、直播7 类内容都能无水印下载到本地。最低门槛改 1 个 YAML 配置文件跑 1 条命令。能力速查输入链接与输出文件对照不用记链接格式把手里的地址丢进配置的link列表程序自行识别并分发。你手里的内容工具给出的结果v.douyin.com/xxx短链解析出原始地址下载无水印最高清版本/video/xxx单个视频.mp4 封面 原声 JSON 元数据/note/xxx图文图集全部图片图片清单写入元数据/collection/xxx合集合集内全部作品逐一拉取/music/xxx音乐优先原声文件缺失时回退该音乐下首条作品/user/xxx作者主页批量无水印下载 post/like/mix/music主页备份live.douyin.com/xxx直播检测清晰度、获取 FLV 流主播下播后已录数据保留--hot-board 30命令抖音热搜榜快照落盘为 JSONL与常见下载脚本的关键差异下载引擎内置SQLite 去重同一作品无论在主页、点赞还是合集模式中出现都只下载一次下载后还有文件完整性校验中断重跑自动跳过已完成部分等价于断点续传。 翻页风控交给browser_fallbackAPI 只能取到 20 条时自动拉起浏览器人工过一次验证即可继续。 产物也不止视频本身封面、原声、作者头像、JSON 元数据可在配置里分别开关作品目录名带aweme_id排查时好定位。从 0 到跑通5 步完成第一次无水印下载整体流程是拉代码 → 装依赖 → 备配置 → 获取 Cookie → 跑命令约 10 分钟第 6 步后第一个文件落盘。拉取代码。克隆仓库并进入内层项目目录git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader预期看到当前目录下出现run.py和config.example.yml。卡在这里入口是内层douyin-downloader目录后续所有命令都在该目录执行别停在仓库外层。安装依赖。第 1 行装核心依赖第 2 行仅当你需要浏览器兜底时才执行pip install -r requirements.txt pip install playwright python -m playwright install chromium预期看到无报错Playwright 本地目录多出一个 chromium 浏览器。卡在这里Python 需 3.8 及以上用python --version确认pip 下载慢可换国内镜像源。准备配置文件。把示例配置复制为程序默认读取的文件名cp config.example.yml config.yml预期看到目录里生成config.yml内容是一份带注释的完整示例。卡在这里提示找不到示例文件时回到第 1 步确认当前在douyin-downloader目录内。获取 Cookie。运行自动获取器在它打开的浏览器里登录一次抖音回终端按回车python -m tools.cookie_fetcher --config config.yml预期看到Cookie 写回config.yml的cookies段。卡在这里浏览器没弹出就检查第 2 步第 2 行是否执行过不行的话也可以手动把整串 Cookie 粘贴到同一位置。写最小配置。打开config.yml只改少数几项示例为作者主页全量批量下载link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx path: ./Downloaded/ mode: - post number: post: 0 # 0 表示不限数量可先改成 1 小规模试跑 thread: 5 # 并发线程数默认 5 database: true # 启用 SQLite 去重预期看到保存后配置覆盖了链接、目录、模式三项要素即可运行。卡在这里只想下单个视频时把link换成视频地址mode仅对主页链接生效。运行命令。python run.py -c config.yml预期看到Rich 进度条出现每个作品按「解析 → 取链 → 写文件」依次完成任务队列的完成数实时更新。跑完打开Downloaded/文件按「作者名 / 作品类型 / 日期_标题_id」组织无水印视频、*_cover.jpg、*_music.mp3、*_data.json成套存放Downloaded/下还有一份download_manifest.jsonl记录每次任务结果便于核对。日志嫌吵不用改progress.quiet_logs默认开启。抖音下载流程的三个高频翻车点现象作者有几百条作品只抓到 20 条就停。原因抖音翻页风控生效API 不再继续翻页。修复config.yml里把browser_fallback设为enabled: true、headless: false弹出浏览器后人工完成验证。现象任务中途提示需要登录或 Cookie 失效。原因抖音定期轮换登录态旧 Cookie 过期。修复重跑python -m tools.cookie_fetcher --config config.yml重新登录一次建议每周刷新。现象想重新下载某条作品重跑时总被跳过。原因程序按「数据库记录 本地文件」双重去重两者都在即视为已完成。修复删除对应作品目录文件名含 aweme_id再执行sqlite3 dy_downloader.db DELETE FROM aweme WHERE aweme_id id;清掉记录。进阶用法把下载器变成自动归档的 2 种方式增量备份长期跟踪某个博主时只拉新作品increase: post: true database: true程序对比 SQLite 记录跳过已完成作品配合start_time/end_time还能按时间段过滤。API 服务模式接进自己的自动化流程pip install fastapi uvicorn python run.py --serve --serve-port 8000服务起来后向/api/v1/download提交{url: ...}即派发下载任务用/api/v1/jobs/{id}查询进度。适用边界适合想收藏视频到本地的人、需要建素材库的创作者与剪辑师、做选题和热点分析的研究者、要备份自己账号作品的用户只下 1 个视频也只需走完上面 5 步不必开启全部能力。不适合不愿碰命令行、只接受图形界面的用户桌面版 Douzy 目前内测中见下图以及下载目标不是抖音内容的场景。请只在合法合规范围内使用尊重原作者版权。更多细节见仓库内 README.zh-CN.md 与 USAGE.md。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表