开发者 · 小红书图文 OCR

小红书图文笔记图片文字提取 API

图文笔记的正文常常整篇在图片里。传一条笔记链接,逐图拿回图片上的字(OCR)和这张图的描述, 再加正文、话题标签、点赞收藏数和要点,一个 JSON。不需要小红书账号,不需要 cookie。

为什么要逐图读

网页里没有字,字在图里

一条真实笔记,服务器端请求、去掉 script 之后整个 DOM 只剩 264 个字符:一个标题「小红书」和一个空的 <div id="app">。HTML 解析得再好也读不出正文——要把每张图读一遍。

2026-10-03 我们查了 TikHub、红狐、社媒数据助手的定价页、平台页和 SDK 说明,都没有提到笔记图片的 OCR(没提不等于没做)。 详见 对比页,每一格都附了出处。

真实返回 · 节选

17 张图,381 段文字,119 秒

首页回放的那条笔记:17 张图逐一描述并读字,得到 381 段屏幕文字和 13 个要点, 用时 119 秒。下面是线上返回的前两张图,一字未改。

{
  "platform": "xiaohongshu",
  "title": "从 Agent Team 到 Agent Swarm(下篇)",
  "author": "周星星",
  "images": [
    {
      "description": "文章封面,绿色背景上画着一群蚂蚁围着一片叶子,下方是文章标题元数据。",
      "ocr": "Multi-Agent · 工程实践 2026.8.4 1.4 万字 约 28 分钟 Multi-agent 的新趋势:从 Agent Team 到 Agent Swarm(下)"
    },
    {
      "description": "第一版架构图,展示四个平等的 Agent 共同读写一个中央 Coordination File。",
      "ocr": "Agent Coordination File 四个地位相同的 agent,全都去读写中间那一个 Coordination File"
    }
  ],
  "ocr_text": [
    "Multi-Agent · 工程实践",
    "2026.8.4",
    "1.4 万字",
    "约 28 分钟"
  ]
}

返回字段

哪些是图上读出来的,哪些是模型写的

字段内容来源
images[].ocr这张图上的字,按图的顺序图上读出
ocr_text所有图上的字合在一起,去重,按出现顺序图上读出
caption / tags笔记正文和话题标签平台
stats点赞、评论、收藏、分享(读取当天的数字,as_of 写日期)平台
images[].description这张图画了什么模型写的
key_points要点,保持原文语言模型写的

用法

一条 curl,或一行 MCP

App 分享出来的链接原样贴进去:xhslink 短链、带 xsec_token 的笔记链接、整段分享文案都行。

curl -X POST https://linkdigest.dev/api/v1/digest \
  -H "Authorization: Bearer ld_live_..." \
  -H "Content-Type: application/json" \
  -d '{"url": "https://www.xiaohongshu.com/discovery/item/6a6bf662000000002402de7e?xsec_token=CBCe01s1uyd2C8uMx6ycYcnEwPV5_31OX1u_I19FCSd54=&xsec_source=app_share", "format": "json"}'

这条链接是首页示例之一,已经被读过并缓存,所以会直接返回 200, 不扣额度。换成你自己的链接:图文和短帖直接返回;需要下载并转写的视频返回 202 和一个 jobId,用同一个 key 去 GET /api/v1/digest/JOB_ID 取结果。

MCP · Claude Code(Cursor、Trae、Cherry Studio、通义灵码见文档)

claude mcp add --transport http linkdigest \
  https://linkdigest.dev/mcp \
  --header "Authorization: Bearer ld_live_..."

API Key 在 https://linkdigest.dev/app/keys 创建(形如 ld_live_…)。 REST、MCP 各客户端的配置、轮询和返回字段见 中文 API / MCP 文档。

价格

按图片数计费,折合人民币

一条内容积分折合人民币
图文笔记,1–6 张图1¥0.144
图文笔记,7–12 张图2¥0.288
图文笔记,17 张图(上面的示例)3¥0.432
图文笔记 6 张图以内 + 爆款拆解2¥0.288
图文笔记 6 张图以内 + 翻译成英文2¥0.288

按加量包折算:$5 = 250 积分,支付宝按人民币结算 ¥36,每积分 ¥0.144。注册送 10 积分(一次性)。 任何人读过的链接再读 0 积分;读不出内容不收费。

做不到的

接之前先看这几条

  • 只返回文本,不返回图片文件。图片在临时目录里处理,请求返回前删除。
  • 一次读一条链接的内容:不做搜索,不抓评论区,不按账号批量抓主页。
  • OCR 结果原样返回、不校对;识别错的字会照样出现在 images[].ocr 里。
  • 不带 xsec_token 的小红书网页地址读不了(小红书返回登录页),请从 App 的分享面板复制链接。

不支持的

先说做不到的

接进去之后才发现读不出来,比现在就知道更糟。以下是明确不支持的,写在这里也写在覆盖表上。

平台 / 类型原因
B站(哔哩哔哩)对我们服务器的地址直接返回 HTTP 412,请求到不了视频。需要代理,目前没有。
X 长文(Articles)只能拿到首图。普通帖子的图片、视频都能读,长文正文读不到。
Instagram代码已接入,但没有端到端验证过,所以不算支持。

常见问题

会被问到的

图片里的字是怎么读出来的?会改写吗?
每张图交给视觉模型读一遍:图上的字原样写进 images[].ocr,另写一句这张图画了什么(images[].description)。OCR 不做改写和校对,识别错的字会照样出现;描述是模型写的。
一条图文笔记多少钱?
6 张图以内 1 积分(约 ¥0.144),之后每多 6 张加 1 积分;17 张图的示例笔记是 3 积分(约 ¥0.432)。任何人读过的链接再读 0 积分,读不出内容不收费。
需要小红书账号或 cookie 吗?
不需要,你不用提供任何东西。读取在我们的服务器上进行,你的账号不参与。
什么样的链接能用?
App 分享出来的 xhslink.com / xhslink.cn 短链、带 xsec_token 的笔记链接、整段分享文案都行。不带 xsec_token 的网页地址会被小红书挡在登录页,从分享面板重新复制即可。
能批量吗?
能。POST /api/v1/digest/batch 一次最多 50 条,可以带签名的 webhook;同一条链接在批次里只算一次。

不用注册先试一条;注册送 10 积分,不用绑卡。支持的平台上有链接读不出来,就是一个值得报告的 bug。