运营 · 内容拆解
对标账号拆解:
把一批链接变成一张表
手里有几十条对标账号的链接,要的是一张表:标题、发布时间、正文、要点、屏幕文字、逐字稿。 下面是今天就能跑通的做法——REST 循环,或者让 agent 自己跑。
流程
三步
收集链接
分享链接原样即可:xhslink.cn/o/…、v.douyin.com/…、youtu.be/…、x.com/…/status/…。短链会解析,追踪参数会去掉, 同一条内容的不同分享命中同一份缓存。
逐条提取
每条链接 POST /api/v1/digest。图文和短帖直接 200;要下载转写的视频返回 202 和 jobId,用 GET /api/v1/digest/JOB_ID 轮询到 200。
写进表
每条返回是同一个结构,不用按平台分支。取下面这几列写 CSV,degraded 非空的行标出来人工看。
REST
一个能直接跑的循环
四条链接都是首页示例,已缓存,跑一遍不扣额度。换成你自己的列表就是真实用法。
# links.txt: 一行一条链接
cat > links.txt <<'LINKS'
https://www.xiaohongshu.com/discovery/item/6a6bf662000000002402de7e?xsec_token=CBCe01s1uyd2C8uMx6ycYcnEwPV5_31OX1u_I19FCSd54=&xsec_source=app_share
https://v.douyin.com/VeXgdE_QwTE
https://www.youtube.com/watch?v=CEvIs9y1uog
https://x.com/ProfTomYeh/status/2091167283057930455
LINKS
while read -r u; do
r=$(curl -s -X POST https://linkdigest.dev/api/v1/digest \
-H "Authorization: Bearer ld_live_..." \
-H "Content-Type: application/json" \
-d "{\"url\": \"$u\", \"format\": \"json\"}")
# 视频会先给 202 + jobId:轮询到 200 为止
job=$(printf '%s' "$r" | jq -r '.jobId // empty')
while [ -n "$job" ] && printf '%s' "$r" | jq -e '.pending' >/dev/null; do
sleep 5
r=$(curl -s https://linkdigest.dev/api/v1/digest/$job \
-H "Authorization: Bearer ld_live_...")
done
printf '%s' "$r" | jq -r '[.platform, .author, .title, .posted_at,
(.key_points | join(" / ")), (.degraded | join("; "))] | @csv'
done < links.txt > duibiao.csvAPI 每小时 60 次调用;几十条一批在一小时内跑完是正常的。批量接口正在做,做好之前就是这个循环。
MCP
或者让 Claude Code 自己跑
接入之后把链接列表贴给它,说清要哪些列。它会逐条调 digest_url, 视频的 job_id 自己处理,最后给你 CSV 或 Markdown 表。
claude mcp add --transport http linkdigest \ https://linkdigest.dev/mcp \ --header "Authorization: Bearer ld_live_..."
把下面这些链接逐条 digest_url,输出一张 Markdown 表: 标题|发布时间|要点(合并成一句)|屏幕文字前 3 条|degraded <贴链接>
表的列
每条返回里值得留的字段
| 字段 | 用途 |
|---|---|
| platform / author / title / posted_at | 谁、什么、什么时候 |
| caption | 正文和话题标签 |
| key_points | 要点,原文语言 |
| ocr_text | 屏幕文字:封面标题、字幕条、图上的字 |
| transcript | 逐字稿,带秒级时间戳 |
| images[].description | 图文笔记每张图的描述 |
| degraded | 非空就是这条比原帖薄,人工看一眼 |
| 平台 / 类型 | 原因 |
|---|---|
| B站(哔哩哔哩) | 对我们服务器的地址直接返回 HTTP 412,请求到不了视频。需要代理,目前没有。 |
| X 长文(Articles) | 只能拿到首图。普通帖子的图片、视频都能读,长文正文读不到。 |
| 代码已接入,但没有端到端验证过,所以不算支持。 |
价格
按工作量计费,不按链接数
dev
$9/月
每月 500 个 credit(积分)。一条普通图文笔记 1 积分,约 $0.018; 视频每开始的 1 分钟 2 积分,一条 10 分钟的视频按公式是 21 积分,约 $0.38。
不计费的
任何人读过的链接再读都免费、不计额度。读不出内容的链接(没有逐字稿、没有屏幕文字、没有图片描述)不收费, 并在一小时内允许重试,而不是把一份空结果缓存一个月。注册有免费试用额度,不用绑卡,具体数字见定价页。
常见问题
会被问到的
- 有批量接口吗?
- 还没有,正在做。目前是一条链接一次调用,图文直接返回,视频返回 jobId 再取。缓存是全局的,团队里第二个人读同一条不计费。
- 一次能跑多少条?
- API 每小时 60 次调用。一批几十条链接的对标账号拆解在一小时内跑完是正常的;更大的量分批跑,或者等批量接口。
- 表里哪些列最有用?
- title、posted_at、caption、key_points 四列能看出选题和节奏;ocr_text 和 transcript 是原文,用来看话术;degraded 非空的行需要人工看一眼。
- 能直接让 Claude Code 干这件事吗?
- 能。接入 MCP 之后把链接列表贴给它,说明要哪些列,它会逐条调 digest_url,遇到视频的 job_id 自己处理,最后输出 CSV 或 Markdown 表。
先免费试,不用绑卡。支持的平台上有链接读不出来,就是一个值得报告的 bug。