给 AI agent,也给运营
把小红书、抖音、TikTok、YouTube、X 的链接,
变成能读的文本
文案提取、视频逐字稿、图文 OCR。一次调用,返回 Markdown 或 JSON:正文、标签、每张图的描述与屏幕文字、 带时间戳的逐字稿、要点。REST API,或者让 Claude Code / Cursor 通过 MCP 自己调。
问题
链接里没有字
一条真实的小红书笔记,用服务器去请求,去掉 script 之后整个 DOM 只剩 264 个字符—— 一个 <title>小红书</title> 和一个空的 <div id="app">。正文在图里,视频没有字幕, 所以「修好 HTML 抽取」得到的仍然是一条干净但空的笔记。
实测
几条真实链接的结果
数字来自线上真实运行,首页的回放就是其中第一条。
| 链接 | 拿到 | 耗时 |
|---|---|---|
| 小红书图文笔记,17 张图 | 17 张图逐一描述,381 段屏幕文字,13 个要点 | 119 秒 |
| 小红书视频笔记 | ASR 逐字稿,56 段屏幕文字,12 个要点 | 约 160 秒 |
| YouTube 演讲 | 426 段转写,190 段屏幕文字 | 缓存命中约 1 秒 |
| X 两图帖子 | 两张图都描述 | 约 20 秒 |
按用途
三种常见的用法
用法
一行接入,或一条 curl
接入 MCP 之后,agent 遇到社交链接会自己调 digest_url,不用你贴任何东西。
MCP · Claude Code / Cursor
claude mcp add --transport http linkdigest \ https://linkdigest.dev/mcp \ --header "Authorization: Bearer ld_live_..."
REST
curl -X POST https://linkdigest.dev/api/v1/digest \
-H "Authorization: Bearer ld_live_..." \
-H "Content-Type: application/json" \
-d '{"url": "https://v.douyin.com/VeXgdE_QwTE", "format": "json"}'这条链接是首页示例之一,已经被读过并缓存,所以会直接返回 200, 不扣额度。换成你自己的链接:图文和短帖直接返回;需要下载并转写的视频返回 202 和一个 jobId,用同一个 key 去 GET /api/v1/digest/JOB_ID 取结果。
| 平台 / 类型 | 原因 |
|---|---|
| B站(哔哩哔哩) | 对我们服务器的地址直接返回 HTTP 412,请求到不了视频。需要代理,目前没有。 |
| X 长文(Articles) | 只能拿到首图。普通帖子的图片、视频都能读,长文正文读不到。 |
| 代码已接入,但没有端到端验证过,所以不算支持。 |
价格
按工作量计费,不按链接数
dev
$9/月
每月 500 个 credit(积分)。一条普通图文笔记 1 积分,约 $0.018; 视频每开始的 1 分钟 2 积分,一条 10 分钟的视频按公式是 21 积分,约 $0.38。
不计费的
任何人读过的链接再读都免费、不计额度。读不出内容的链接(没有逐字稿、没有屏幕文字、没有图片描述)不收费, 并在一小时内允许重试,而不是把一份空结果缓存一个月。注册有免费试用额度,不用绑卡,具体数字见定价页。
常见问题
会被问到的
- 为什么不能直接 curl 或者让 agent 自己打开链接?
- 一条真实的小红书笔记,去掉 script 之后整个 DOM 只有 264 个字符:标题是「小红书」,没有正文、没有图。内容在图片和视频里,页面里没有可读的字。抖音、TikTok 同理。
- 小红书需要我提供 cookie 或登录吗?
- 不需要。图文笔记和视频笔记都不用登录读取,你不需要给我们任何账号信息,也没有你的账号会被封。
- 抖音呢?
- 抖音拒绝匿名请求,所以抖音那条路跑在我们自己的会话上。会话会过期,过期了是我们的问题、我们来续,不用你操心。
- 中文语音的逐字稿准吗?
- 转写用的是 SenseVoice,中文上明显优于 Whisper 一类的模型。平台自带字幕时优先用字幕,更准也免费。
- 会保存我的视频或图片吗?
- 不会。媒体在临时目录里处理,请求返回前删除,只保留文本结果。这也是为什么任何人读过的链接再读都免费。
先免费试,不用绑卡。支持的平台上有链接读不出来,就是一个值得报告的 bug。