从0到1走完小红书采集全流程:XHS-Downloader 链接提取与作品下载实战 从0到1走完小红书采集全流程XHS-Downloader 链接提取与作品下载实战【免费下载链接】XHS-Downloader小红书XiaoHongShu、RedNote链接提取/作品采集工具提取账号发布、收藏、点赞、专辑作品链接提取搜索结果作品、用户链接采集小红书作品信息提取小红书作品下载地址下载小红书作品文件项目地址: https://gitcode.com/gh_mirrors/xh/XHS-DownloaderXHS-Downloader 是一款开源的小红书作品采集工具核心是把账号发布、收藏、点赞、专辑里的作品链接批量提取出来再下载为高清图文与视频文件同时提供命令行、图形界面、浏览器脚本和 API/MCP 服务几种用法。它适合内容创作者、电商运营、市场分析师也适合单纯想把收藏夹搬到本地的普通用户。这篇文章不讲堆砌的功能清单而是跟着一次真实的采集过程从装好到跑通一步步看它到底能帮你省下多少时间。先讲一段真实经历收藏夹里攒了两年的笔记一个下午搬回本地我的小红书收藏夹里躺着 300 多条笔记有探店攻略、装修灵感、配方教程全是当时先收藏再说的。直到某天想找一张两年前看过的图才发现问题很现实要么翻半天找不到原图要么截图下来的画质糊到没法用。于是那个周末我试着手动整理。打开一条多图笔记点开大图长按保存再切回列表继续下一条。一条 5~9 张图的笔记平均要花 1 分多钟300 条就是大半天还没算视频——视频根本没法靠截图保留。后来我换了个思路先把要哪些作品这件事交给浏览器脚本把下载成文件这件事交给本地程序。实测下来提取 300 条收藏链接花了 3 分钟程序批量下载时大部分作品几秒一条加上处理出错重试全程约 25 分钟收工。这篇文章就是那次过程的重现你可以照着走一遍。第一步先跑通单个作品下载装好运行环境两条命令启动项目基于 Python 开发需要 3.12 及以上版本。如果你本地有uv一个很省心的 Python 包管理器安装过程只有两条命令git clone https://gitcode.com/gh_mirrors/xh/XHS-Downloader cd XHS-Downloader uv sync --no-dev # 安装项目依赖只装运行所需不装开发依赖 uv run main.py # 启动程序默认进入图形界面如果你不想碰命令行也可以去项目的 Releases 页面下载现成的可执行文件压缩包解压后双击main就能用Windows 和 macOS 都有对应的包。用一条命令下载第一个作品先把程序跑起来最简单的方式其实是命令行模式。复制一条小红书作品链接比如https://www.xiaohongshu.com/explore/作品ID?xsec_tokenXXX然后执行# 下载单个作品链接必须放在引号里 python main.py --url https://www.xiaohongshu.com/explore/作品ID?xsec_tokenXXX程序会自动识别链接、提取作品信息、下载文件并在终端里打印出作品标题、类型、下载地址和保存位置。图文作品默认存成 JPEG视频作品会优先取分辨率最高的源文件。命令行支持的全部参数运行程序时就能看到一份带中文说明的参数表这里截一张图给你参考第一次跑通之后你会发现下载一条作品从打开页面、逐张保存变成了一条命令的事。而真正省时间的是后面这几招。两个高频需求图集挑图以及视频要高清只想下载图集中的某几张怎么办有些图集动辄十几张图但你要的可能只是其中两三张。命令行提供了一个--index参数专门指定要下载第几张# 只下载第 1、3、5 张图片 python main.py --url 图文作品链接 --index 1 3 5注意两个小细节设置--index后一次只处理一个作品链接多个序号之间用空格分隔。如果没设置这个参数你可以在一条命令里放多个链接程序会自动过滤出有效的那部分# 一次批量下载多个作品链接之间用空格分隔 python main.py --url 链接A 链接B 链接C视频只有低分辨率补一个 Cookie 配置如果你下载的视频总是低清晰度多半是没配置 Cookie。不配置也能下载但视频文件会被限制在低分辨率填上 Cookie 后就能拿到高画质的源文件而且不需要登录账号。获取方式不算麻烦浏览器打开小红书首页按F12打开开发者工具切到网络选项卡勾选保留日志过滤cookie-name:web_session再点开任意一篇作品从请求包里复制完整的 Cookie 值即可。具体位置可以看这张示意图拿到 Cookie 后最省事的做法是写进配置文件Volume/settings.json首次运行程序会自动生成这个文件以后每次下载都会自动带上。同个文件里还可以改下载格式image_format支持 JPEG、WEBP、PNG、HEIC 和 AUTO、图片下载开关、视频偏好分辨率优先还是码率优先等参数改完重启程序生效。批量采集的标准打法浏览器脚本提取链接程序负责下载单个作品手动复制链接还行但要采集某个账号的全部发布、收藏或点赞作品手动复制就太慢了。这时候就该请出项目的另一半浏览器用户脚本。两分钟装好用户脚本用户脚本运行在 Tampermonkey篡改猴这类扩展里。仓库里已经准备好了现成的脚本文件static/XHS-Downloader.js你只需要在浏览器里安装 Tampermonkey 扩展打开扩展面板选择从 URL 安装填入脚本地址安装完成后刷新小红书页面装好后进入小红书任意页面点击脚本菜单你会看到提取发布作品链接提取点赞作品链接提取收藏作品链接这些选项以及一个设置入口从提取链接到批量下载一条流水线以提取收藏作品链接为例点一下菜单脚本会自动滚动页面加载全部收藏然后把所有作品链接整理到剪贴板。你把链接粘贴出来一条命令交给程序python main.py --url 链接A 链接B 链接C ... --work_path ./my_downloads --name_format 发布时间 作者昵称 作品标题--work_path指定保存根目录--name_format控制文件名——支持按发布时间、作者昵称、作品标题、作品 ID、点赞数等字段自由组合整理素材库时很好用。如果希望每个作品的文件单独放一个文件夹再加一个--folder_mode true希望每个作者的作品归到各自文件夹用--author_archive true。更进一步让程序在后台接收脚本推送每次复制链接再跑命令还是有点手动。项目支持让浏览器脚本和本地程序联动在Volume/settings.json里把script_server设为true保持程序在后台运行浏览器里点脚本菜单的推送下载任务链接会直接发给程序由程序自行完成下载。文件命名、格式这些规则都按程序的配置执行。这么一套组合下来我那次整理收藏夹的实际耗时是脚本提取链接 3 分钟程序批量下载约 20 分钟中间还包含了两次断网重试——程序内置了失败重试和断点续传中断后重跑会自动接着下已经下载过的作品也会被记录并自动跳过不会重复占用时间。不想敲命令图形界面和剪贴板监听了解一下命令行适合批量但如果只是偶尔下几个作品图形界面更顺手。uv run main.py启动后进入的就是这个界面直接粘贴链接、点下载作品文件就行还内置了读取剪贴板——复制一条链接在程序里按一下就能读取无需手动粘贴界面底部的快捷键很直观Q退出、U检查更新、S程序设置、R查看下载记录。设置界面里那些参数和settings.json是一一对应的不习惯编辑 JSON 的人可以直接在界面里点选。进阶玩法把下载能力封装成本地 API 或 MCP 服务如果你有二次开发需求或者想把它接进 AI 助手项目还提供了两种服务模式。API 模式执行python main.py api会启动一个本地服务浏览器访问http://127.0.0.1:5556/docs能看到自动生成的交互式接口文档。核心接口是POST /xhs/detail一个最小调用示例from httpx import post server http://127.0.0.1:5556/xhs/detail data { url: https://www.xiaohongshu.com/explore/作品ID?xsec_tokenXXX, # 作品链接必填 download: True, # 是否同时下载文件 index: [1, 3, 5], # 图集作品只下载这几张可选 } response post(server, jsondata, timeout30) print(response.json())这适合写脚本做自动化的人。仓库里的example.py还提供了不经过服务、直接在代码里调用XHS类的示例参数注释写得很全想定制逻辑可以从它改起。MCP 模式执行python main.py mcp然后在支持 MCP 的客户端比如各种 AI 编程工具里配置一个 streamable HTTP 服务地址填http://127.0.0.1:5556/mcp/配置完成后AI 助手可以直接帮你查这篇作品的信息或下载这个作品的文件相当于把采集能力变成了对话里的一个工具。感兴趣的话项目源码里source/application/目录放着请求与下载的核心逻辑source/TUI/是图形界面部分都可以顺着看下去。新手常问的几个问题我踩过的坑不配置 Cookie 真的能用吗能。大部分功能不依赖 Cookie 也能跑区别主要在视频清晰度——不配置只能拿到低分辨率版本。另外提醒一句作品链接里携带日期信息隔了太久再用旧链接可能触发风控建议下载时用最新提取的链接。下载过的作品会不会重复下载默认不会。程序会把下载成功的作品 ID 记进数据库再次遇到同样的链接会自动跳过。想强制重新下载去Volume/ExploreID.db里删掉对应记录即可。批量下载几百条会被平台盯上吗项目内置了请求延时机制会控制请求频率正常使用问题不大。但要注意脚本里的自动滚动页面功能默认是关闭的开启后脚本会快速滚动加载内容这种行为有可能被平台判定为自动化操作风险自担。我用的时候选择手动滚动几次页面稳妥一点。和浏览器长截图、录屏比差别有多大长截图是像素级的放大就糊录屏同理。程序下载的是服务器上的原始文件图片按你指定的格式保存视频取高清源文件还支持 livePhoto 这类动图格式。更关键的是批量手动一条条保存和一条命令下载时间差着量级。这几类人最值得花十分钟试试内容创作者需要大量参考素材电商运营要盯竞品账号分析师要收集样本数据普通用户只是想把收藏夹整理成能检索的个人资料库——你们的共同点是作品要留下来还要留得清楚。XHS-Downloader 把提取链接和下载文件这两件事拆成了两个可以自由组合的环节你既可以只用浏览器脚本收集链接也可以只跑程序下载两边都开源、免费、持续更新。我的建议很朴素别急着研究全部参数先从收藏夹里挑一篇笔记用命令行下下来感受一下一条命令换一个本地文件是什么体验。顺手了再回头看批量采集那部分你会觉得值得。【免费下载链接】XHS-Downloader小红书XiaoHongShu、RedNote链接提取/作品采集工具提取账号发布、收藏、点赞、专辑作品链接提取搜索结果作品、用户链接采集小红书作品信息提取小红书作品下载地址下载小红书作品文件项目地址: https://gitcode.com/gh_mirrors/xh/XHS-Downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考