开发者 · 微信公众号

公众号文章提取 API

传一条 mp.weixin.qq.com 链接,拿回一个 JSON:全文正文、公众号名、发布日期、每张图片的描述和图上的文字、要点(每条附一句原文引用)、 文末链接和二维码指向的地址,以及一份「读了多少」的回执。不需要微信登录。

真实返回 · 节选

一篇 16 张图的公众号文章

2026-10-06 线上实际读取:正文 4,683 字,16 张图全部读出,3 积分,约 110 秒。字段如下,文字截短了,其余原样(图片描述目前是英文,要中文可加 translate_to)。

{
  "platform": "web",
  "title": "今年最难的机器人Demo,“机器人含量”为0",
  "author": "量子位",
  "posted_at": "2026-09-02",
  "caption": "(全文正文,4,683 字)…",
  "images": [
    { "description": "A close-up shot of a white robotic gripper interacting with …", "ocr": "Autonomous. 3X 但对空间堆叠、驱动力矩密度与部署可靠性的要求随之陡…" },
    { "description": "A side view of a white robotic arm end-effector with visible …", "ocr": "Autonomous. 3X 末端构型是经过系统权衡的工程决策 …" }
  ],
  "key_points": ["…"],
  "key_point_support": [{ "point_index": 0, "kind": "caption", "quote": "…", "verified": true }],
  "links": [{ "url": "https://x2robot.com/pages/twindex", "found_in": "caption", "label": "项目主页", "kind": "web" }],
  "coverage": { "images_read": 16, "images_total": 16, "not_captured": ["comments not read"] },
  "image_count": 16,
  "images_read": 16,
  "degraded": []
}

字段

哪些是文章本身的,哪些是模型写的

caption · images[].ocr · links · author · posted_at

来自文章本身:正文原文、图上的文字、文章指向的链接、公众号名和日期。

images[].description · key_points

模型写的:每张图的画面描述,以及要点。每条要点在 key_point_support 里附一句原文引用,由代码逐字核对过;verified 为 false 的那条请自己对照。

用法

一条 curl,或一行 MCP

curl -X POST https://linkdigest.dev/api/v1/digest \
  -H "Authorization: Bearer ld_live_..." \
  -H "Content-Type: application/json" \
  -d '{"url": "https://mp.weixin.qq.com/s/XXXXXXXX", "format": "json"}'

这条链接是首页示例之一,已经被读过并缓存,所以会直接返回 200, 不扣额度。换成你自己的链接:图文和短帖直接返回;需要下载并转写的视频返回 202 和一个 jobId,用同一个 key 去 GET /api/v1/digest/JOB_ID 取结果。

# 返回 202 时:用同一个 Key 取结果,每次最多等 20 秒(长文章可能要 1–2 分钟)
curl "https://linkdigest.dev/api/v1/digest/JOB_ID?wait=20" -H "Authorization: Bearer ld_live_..."

MCP · Claude Code(Cursor、Trae、Cherry Studio、通义灵码见文档)

claude mcp add --transport http linkdigest \
  https://linkdigest.dev/mcp \
  --header "Authorization: Bearer ld_live_..."

API Key 在 https://linkdigest.dev/app/keys 创建(形如 ld_live_…)。 REST、MCP 各客户端的配置、轮询和返回字段见 中文 API / MCP 文档。

用 OpenClaw?装现成的技能:clawhub install jackchew7143/linkdigest-wechat-article-reader。

价格

按图片数计费,折合人民币

基础 1 积分含 6 张图,每多 6 张 +1。读过的同一篇文章再读 0 积分;读不出内容不收费。

一条内容积分折合人民币
6 张图以内1¥0.144
7–12 张图2¥0.288
16 张图(下面这篇)3¥0.432
30 张图5¥0.72
60 张图(单篇上限)10¥1.44
加英文译文2¥0.288

按加量包折算:$5 = 250 积分,支付宝按人民币结算 ¥36,每积分 ¥0.144。注册送 10 积分(一次性)。 任何人读过的链接再读 0 积分;读不出内容不收费。

做不到的

接之前先看这几条

  • 一次读一条链接:不搜索文章,不读某个公众号的历史文章列表,不读评论、阅读数和在看数。
  • 文章里的视频和音频不转写。
  • 花体字、手写字和很小的字可能认错;涉及价格、数字时请对照原图。
  • 文字结果按链接缓存,同一篇公开文章再读免费,也可能提供给请求同一链接的其他用户;不要提交内部或私密链接。 同一个 Key 还能读小红书和抖音。

不支持的

先说做不到的

接进去之后才发现读不出来,比现在就知道更糟。以下是明确不支持的,写在这里也写在覆盖表上。

平台 / 类型原因
B站(哔哩哔哩)对我们服务器的地址直接返回 HTTP 412,请求到不了视频。需要代理,目前没有。
X 长文(Articles)只能拿到首图。普通帖子的图片、视频都能读,长文正文读不到。
Instagram代码已接入,但没有端到端验证过,所以不算支持。

常见问题

会被问到的

和直接抓网页有什么区别?
公众号文章的干货常在图里:长图、聊天截图、数据表、海报。普通抓取只拿到正文文字,图里的内容全丢。这里每张图都返回一段描述和图上的文字,按文章里的顺序排好。
需要微信登录或 cookie 吗?
不需要。只读公开文章;已删除、被屏蔽、需要登录或付费才能看的文章读不了,返回 422,不扣费。
文章里的视频和音频呢?
目前不转写。只读正文和图片;回执(coverage)里会写明没读到的部分。
图太多、积分不够怎么办?
不会报错。先读积分够的前几张(每个积分 6 张),结果里的 partial 和 degraded 写明读到第几张;单篇最多读 60 张。
文末「阅读原文」和二维码能拿到吗?
能。links 字段列出文章指向的链接:「阅读原文」、正文里的网址、图片里的二维码;只列出,不打开。收款码和拉群码会标明。

不用注册先试一条;注册送 10 积分,不用绑卡。支持的平台上有链接读不出来,就是一个值得报告的 bug。