运营 · 内容拆解

对标账号拆解:
把一批链接变成一张表

手里有几十条对标账号的链接,要的是一张表:标题、发布时间、正文、要点、屏幕文字、逐字稿。 下面是今天就能跑通的做法——REST 循环,或者让 agent 自己跑。

流程

三步

收集链接

分享链接原样即可:xhslink.cn/o/…v.douyin.com/…youtu.be/…x.com/…/status/…。短链会解析,追踪参数会去掉, 同一条内容的不同分享命中同一份缓存。

逐条提取

每条链接 POST /api/v1/digest。图文和短帖直接 200;要下载转写的视频返回 202 jobId,用 GET /api/v1/digest/JOB_ID 轮询到 200

写进表

每条返回是同一个结构,不用按平台分支。取下面这几列写 CSV,degraded 非空的行标出来人工看。

REST

一个能直接跑的循环

四条链接都是首页示例,已缓存,跑一遍不扣额度。换成你自己的列表就是真实用法。

# links.txt: 一行一条链接
cat > links.txt <<'LINKS'
https://www.xiaohongshu.com/discovery/item/6a6bf662000000002402de7e?xsec_token=CBCe01s1uyd2C8uMx6ycYcnEwPV5_31OX1u_I19FCSd54=&xsec_source=app_share
https://v.douyin.com/VeXgdE_QwTE
https://www.youtube.com/watch?v=CEvIs9y1uog
https://x.com/ProfTomYeh/status/2091167283057930455
LINKS

while read -r u; do
  r=$(curl -s -X POST https://linkdigest.dev/api/v1/digest \
        -H "Authorization: Bearer ld_live_..." \
        -H "Content-Type: application/json" \
        -d "{\"url\": \"$u\", \"format\": \"json\"}")
  # 视频会先给 202 + jobId:轮询到 200 为止
  job=$(printf '%s' "$r" | jq -r '.jobId // empty')
  while [ -n "$job" ] && printf '%s' "$r" | jq -e '.pending' >/dev/null; do
    sleep 5
    r=$(curl -s https://linkdigest.dev/api/v1/digest/$job \
          -H "Authorization: Bearer ld_live_...")
  done
  printf '%s' "$r" | jq -r '[.platform, .author, .title, .posted_at,
    (.key_points | join(" / ")), (.degraded | join("; "))] | @csv'
done < links.txt > duibiao.csv

API 每小时 60 次调用;几十条一批在一小时内跑完是正常的。批量接口正在做,做好之前就是这个循环。

MCP

或者让 Claude Code 自己跑

接入之后把链接列表贴给它,说清要哪些列。它会逐条调 digest_url, 视频的 job_id 自己处理,最后给你 CSV 或 Markdown 表。

claude mcp add --transport http linkdigest \
  https://linkdigest.dev/mcp \
  --header "Authorization: Bearer ld_live_..."
把下面这些链接逐条 digest_url,输出一张 Markdown 表:
标题|发布时间|要点(合并成一句)|屏幕文字前 3 条|degraded

<贴链接>

表的列

每条返回里值得留的字段

字段用途
platform / author / title / posted_at谁、什么、什么时候
caption正文和话题标签
key_points要点,原文语言
ocr_text屏幕文字:封面标题、字幕条、图上的字
transcript逐字稿,带秒级时间戳
images[].description图文笔记每张图的描述
degraded非空就是这条比原帖薄,人工看一眼

完整字段说明见英文文档。小红书和抖音各自的细节见小红书笔记提取抖音文案提取

不支持的

先说做不到的

接进去之后才发现读不出来,比现在就知道更糟。以下是明确不支持的,写在这里也写在覆盖表上。

平台 / 类型原因
B站(哔哩哔哩)对我们服务器的地址直接返回 HTTP 412,请求到不了视频。需要代理,目前没有。
X 长文(Articles)只能拿到首图。普通帖子的图片、视频都能读,长文正文读不到。
Instagram代码已接入,但没有端到端验证过,所以不算支持。

价格

按工作量计费,不按链接数

dev

$9/月

每月 500 个 credit(积分)。一条普通图文笔记 1 积分,约 $0.018; 视频每开始的 1 分钟 2 积分,一条 10 分钟的视频按公式是 21 积分,约 $0.38

不计费的

任何人读过的链接再读都免费、不计额度。读不出内容的链接(没有逐字稿、没有屏幕文字、没有图片描述)不收费, 并在一小时内允许重试,而不是把一份空结果缓存一个月。注册有免费试用额度,不用绑卡,具体数字见定价页

常见问题

会被问到的

有批量接口吗?
还没有,正在做。目前是一条链接一次调用,图文直接返回,视频返回 jobId 再取。缓存是全局的,团队里第二个人读同一条不计费。
一次能跑多少条?
API 每小时 60 次调用。一批几十条链接的对标账号拆解在一小时内跑完是正常的;更大的量分批跑,或者等批量接口。
表里哪些列最有用?
title、posted_at、caption、key_points 四列能看出选题和节奏;ocr_text 和 transcript 是原文,用来看话术;degraded 非空的行需要人工看一眼。
能直接让 Claude Code 干这件事吗?
能。接入 MCP 之后把链接列表贴给它,说明要哪些列,它会逐条调 digest_url,遇到视频的 job_id 自己处理,最后输出 CSV 或 Markdown 表。

先免费试,不用绑卡。支持的平台上有链接读不出来,就是一个值得报告的 bug。