开发者 · 小红书图文 OCR
小红书图文笔记图片文字提取 API
图文笔记的正文常常整篇在图片里。传一条笔记链接,逐图拿回图片上的字(OCR)和这张图的描述, 再加正文、话题标签、点赞收藏数和要点,一个 JSON。不需要小红书账号,不需要 cookie。
为什么要逐图读
网页里没有字,字在图里
一条真实笔记,服务器端请求、去掉 script 之后整个 DOM 只剩 264 个字符:一个标题「小红书」和一个空的 <div id="app">。HTML 解析得再好也读不出正文——要把每张图读一遍。
2026-10-03 我们查了 TikHub、红狐、社媒数据助手的定价页、平台页和 SDK 说明,都没有提到笔记图片的 OCR(没提不等于没做)。 详见 对比页,每一格都附了出处。
真实返回 · 节选
17 张图,381 段文字,119 秒
首页回放的那条笔记:17 张图逐一描述并读字,得到 381 段屏幕文字和 13 个要点, 用时 119 秒。下面是线上返回的前两张图,一字未改。
{
"platform": "xiaohongshu",
"title": "从 Agent Team 到 Agent Swarm(下篇)",
"author": "周星星",
"images": [
{
"description": "文章封面,绿色背景上画着一群蚂蚁围着一片叶子,下方是文章标题元数据。",
"ocr": "Multi-Agent · 工程实践 2026.8.4 1.4 万字 约 28 分钟 Multi-agent 的新趋势:从 Agent Team 到 Agent Swarm(下)"
},
{
"description": "第一版架构图,展示四个平等的 Agent 共同读写一个中央 Coordination File。",
"ocr": "Agent Coordination File 四个地位相同的 agent,全都去读写中间那一个 Coordination File"
}
],
"ocr_text": [
"Multi-Agent · 工程实践",
"2026.8.4",
"1.4 万字",
"约 28 分钟"
]
}返回字段
哪些是图上读出来的,哪些是模型写的
| 字段 | 内容 | 来源 |
|---|---|---|
| images[].ocr | 这张图上的字,按图的顺序 | 图上读出 |
| ocr_text | 所有图上的字合在一起,去重,按出现顺序 | 图上读出 |
| caption / tags | 笔记正文和话题标签 | 平台 |
| stats | 点赞、评论、收藏、分享(读取当天的数字,as_of 写日期) | 平台 |
| images[].description | 这张图画了什么 | 模型写的 |
| key_points | 要点,保持原文语言 | 模型写的 |
用法
一条 curl,或一行 MCP
App 分享出来的链接原样贴进去:xhslink 短链、带 xsec_token 的笔记链接、整段分享文案都行。
curl -X POST https://linkdigest.dev/api/v1/digest \
-H "Authorization: Bearer ld_live_..." \
-H "Content-Type: application/json" \
-d '{"url": "https://www.xiaohongshu.com/discovery/item/6a6bf662000000002402de7e?xsec_token=CBCe01s1uyd2C8uMx6ycYcnEwPV5_31OX1u_I19FCSd54=&xsec_source=app_share", "format": "json"}'这条链接是首页示例之一,已经被读过并缓存,所以会直接返回 200, 不扣额度。换成你自己的链接:图文和短帖直接返回;需要下载并转写的视频返回 202 和一个 jobId,用同一个 key 去 GET /api/v1/digest/JOB_ID 取结果。
MCP · Claude Code(Cursor、Trae、Cherry Studio、通义灵码见文档)
claude mcp add --transport http linkdigest \ https://linkdigest.dev/mcp \ --header "Authorization: Bearer ld_live_..."
API Key 在 https://linkdigest.dev/app/keys 创建(形如 ld_live_…)。 REST、MCP 各客户端的配置、轮询和返回字段见 中文 API / MCP 文档。
价格
按图片数计费,折合人民币
| 一条内容 | 积分 | 折合人民币 |
|---|---|---|
| 图文笔记,1–6 张图 | 1 | ¥0.144 |
| 图文笔记,7–12 张图 | 2 | ¥0.288 |
| 图文笔记,17 张图(上面的示例) | 3 | ¥0.432 |
| 图文笔记 6 张图以内 + 爆款拆解 | 2 | ¥0.288 |
| 图文笔记 6 张图以内 + 翻译成英文 | 2 | ¥0.288 |
按加量包折算:$5 = 250 积分,支付宝按人民币结算 ¥36,每积分 ¥0.144。注册送 10 积分(一次性)。 任何人读过的链接再读 0 积分;读不出内容不收费。
做不到的
接之前先看这几条
- 只返回文本,不返回图片文件。图片在临时目录里处理,请求返回前删除。
- 一次读一条链接的内容:不做搜索,不抓评论区,不按账号批量抓主页。
- OCR 结果原样返回、不校对;识别错的字会照样出现在 images[].ocr 里。
- 不带 xsec_token 的小红书网页地址读不了(小红书返回登录页),请从 App 的分享面板复制链接。
| 平台 / 类型 | 原因 |
|---|---|
| B站(哔哩哔哩) | 对我们服务器的地址直接返回 HTTP 412,请求到不了视频。需要代理,目前没有。 |
| X 长文(Articles) | 只能拿到首图。普通帖子的图片、视频都能读,长文正文读不到。 |
| 代码已接入,但没有端到端验证过,所以不算支持。 |
常见问题
会被问到的
- 图片里的字是怎么读出来的?会改写吗?
- 每张图交给视觉模型读一遍:图上的字原样写进 images[].ocr,另写一句这张图画了什么(images[].description)。OCR 不做改写和校对,识别错的字会照样出现;描述是模型写的。
- 一条图文笔记多少钱?
- 6 张图以内 1 积分(约 ¥0.144),之后每多 6 张加 1 积分;17 张图的示例笔记是 3 积分(约 ¥0.432)。任何人读过的链接再读 0 积分,读不出内容不收费。
- 需要小红书账号或 cookie 吗?
- 不需要,你不用提供任何东西。读取在我们的服务器上进行,你的账号不参与。
- 什么样的链接能用?
- App 分享出来的 xhslink.com / xhslink.cn 短链、带 xsec_token 的笔记链接、整段分享文案都行。不带 xsec_token 的网页地址会被小红书挡在登录页,从分享面板重新复制即可。
- 能批量吗?
- 能。POST /api/v1/digest/batch 一次最多 50 条,可以带签名的 webhook;同一条链接在批次里只算一次。
不用注册先试一条;注册送 10 积分,不用绑卡。支持的平台上有链接读不出来,就是一个值得报告的 bug。