开发者 · 微信公众号
公众号文章提取 API
传一条 mp.weixin.qq.com 链接,拿回一个 JSON:全文正文、公众号名、发布日期、每张图片的描述和图上的文字、要点(每条附一句原文引用)、 文末链接和二维码指向的地址,以及一份「读了多少」的回执。不需要微信登录。
真实返回 · 节选
一篇 16 张图的公众号文章
2026-10-06 线上实际读取:正文 4,683 字,16 张图全部读出,3 积分,约 110 秒。字段如下,文字截短了,其余原样(图片描述目前是英文,要中文可加 translate_to)。
{
"platform": "web",
"title": "今年最难的机器人Demo,“机器人含量”为0",
"author": "量子位",
"posted_at": "2026-09-02",
"caption": "(全文正文,4,683 字)…",
"images": [
{ "description": "A close-up shot of a white robotic gripper interacting with …", "ocr": "Autonomous. 3X 但对空间堆叠、驱动力矩密度与部署可靠性的要求随之陡…" },
{ "description": "A side view of a white robotic arm end-effector with visible …", "ocr": "Autonomous. 3X 末端构型是经过系统权衡的工程决策 …" }
],
"key_points": ["…"],
"key_point_support": [{ "point_index": 0, "kind": "caption", "quote": "…", "verified": true }],
"links": [{ "url": "https://x2robot.com/pages/twindex", "found_in": "caption", "label": "项目主页", "kind": "web" }],
"coverage": { "images_read": 16, "images_total": 16, "not_captured": ["comments not read"] },
"image_count": 16,
"images_read": 16,
"degraded": []
}字段
哪些是文章本身的,哪些是模型写的
caption · images[].ocr · links · author · posted_at
来自文章本身:正文原文、图上的文字、文章指向的链接、公众号名和日期。
images[].description · key_points
模型写的:每张图的画面描述,以及要点。每条要点在 key_point_support 里附一句原文引用,由代码逐字核对过;verified 为 false 的那条请自己对照。
用法
一条 curl,或一行 MCP
curl -X POST https://linkdigest.dev/api/v1/digest \
-H "Authorization: Bearer ld_live_..." \
-H "Content-Type: application/json" \
-d '{"url": "https://mp.weixin.qq.com/s/XXXXXXXX", "format": "json"}'这条链接是首页示例之一,已经被读过并缓存,所以会直接返回 200, 不扣额度。换成你自己的链接:图文和短帖直接返回;需要下载并转写的视频返回 202 和一个 jobId,用同一个 key 去 GET /api/v1/digest/JOB_ID 取结果。
# 返回 202 时:用同一个 Key 取结果,每次最多等 20 秒(长文章可能要 1–2 分钟) curl "https://linkdigest.dev/api/v1/digest/JOB_ID?wait=20" -H "Authorization: Bearer ld_live_..."
MCP · Claude Code(Cursor、Trae、Cherry Studio、通义灵码见文档)
claude mcp add --transport http linkdigest \ https://linkdigest.dev/mcp \ --header "Authorization: Bearer ld_live_..."
API Key 在 https://linkdigest.dev/app/keys 创建(形如 ld_live_…)。 REST、MCP 各客户端的配置、轮询和返回字段见 中文 API / MCP 文档。
用 OpenClaw?装现成的技能:clawhub install jackchew7143/linkdigest-wechat-article-reader。
价格
按图片数计费,折合人民币
基础 1 积分含 6 张图,每多 6 张 +1。读过的同一篇文章再读 0 积分;读不出内容不收费。
| 一条内容 | 积分 | 折合人民币 |
|---|---|---|
| 6 张图以内 | 1 | ¥0.144 |
| 7–12 张图 | 2 | ¥0.288 |
| 16 张图(下面这篇) | 3 | ¥0.432 |
| 30 张图 | 5 | ¥0.72 |
| 60 张图(单篇上限) | 10 | ¥1.44 |
| 加英文译文 | 2 | ¥0.288 |
按加量包折算:$5 = 250 积分,支付宝按人民币结算 ¥36,每积分 ¥0.144。注册送 10 积分(一次性)。 任何人读过的链接再读 0 积分;读不出内容不收费。
做不到的
接之前先看这几条
| 平台 / 类型 | 原因 |
|---|---|
| B站(哔哩哔哩) | 对我们服务器的地址直接返回 HTTP 412,请求到不了视频。需要代理,目前没有。 |
| X 长文(Articles) | 只能拿到首图。普通帖子的图片、视频都能读,长文正文读不到。 |
| 代码已接入,但没有端到端验证过,所以不算支持。 |
常见问题
会被问到的
- 和直接抓网页有什么区别?
- 公众号文章的干货常在图里:长图、聊天截图、数据表、海报。普通抓取只拿到正文文字,图里的内容全丢。这里每张图都返回一段描述和图上的文字,按文章里的顺序排好。
- 需要微信登录或 cookie 吗?
- 不需要。只读公开文章;已删除、被屏蔽、需要登录或付费才能看的文章读不了,返回 422,不扣费。
- 文章里的视频和音频呢?
- 目前不转写。只读正文和图片;回执(coverage)里会写明没读到的部分。
- 图太多、积分不够怎么办?
- 不会报错。先读积分够的前几张(每个积分 6 张),结果里的 partial 和 degraded 写明读到第几张;单篇最多读 60 张。
- 文末「阅读原文」和二维码能拿到吗?
- 能。links 字段列出文章指向的链接:「阅读原文」、正文里的网址、图片里的二维码;只列出,不打开。收款码和拉群码会标明。
不用注册先试一条;注册送 10 积分,不用绑卡。支持的平台上有链接读不出来,就是一个值得报告的 bug。