开发者 · 抖音
抖音文案提取 API
传一条抖音链接(v.douyin.com 短链或整段分享文案都行),拿回一个 JSON:语音逐字稿、画面里的字(带大致时间)、 正文、话题标签、点赞收藏数和要点;加一个参数还有爆款拆解。不给视频文件,不用你的 cookie。
真实返回 · 节选
一条 15 分 42 秒的剪辑教程
2026-10-03 线上实际返回的字段,文字截短了,其余原样。来源视频:https://www.douyin.com/video/7515405363630443830
{
"platform": "douyin",
"title": "剪辑全套教程【关键帧丝滑动画的奥秘】",
"author": "视频剪辑教学",
"posted_at": "2025-06-13",
"duration_seconds": 942.082,
"transcript_source": "asr",
"transcript": [
{ "t": 0, "text": "接下来的课程呢,干货满满,请大家做好笔记。…" },
{ "t": 170, "text": "…" },
{ "t": 340, "text": "…" }
],
"on_screen": [
{ "t": 0, "text": "需要的小伙伴扣六就可以领取啦" },
{ "t": 447.49, "text": "添加上面来把它缩放调小到50哎" },
{ "t": 471.04, "text": "反射角度为180" }
],
"stats": { "likes": 60, "comments": 5, "collects": 14, "shares": 1, "as_of": "2026-10-03" },
"tags": ["视频剪辑", "pr教程", "学剪辑", "pr", "剪辑"],
"key_points": ["课程核心在于揭示关键帧动画“丝滑”和“有韵律”的原理,…"],
"degraded": []
}时间戳
逐字稿按段给时间,画面文字带大致秒数
transcript
语音识别用 Qwen3-ASR,它只返回文字、不返回逐句时间。所以逐字稿按段给,每段最长约 170 秒, t 是这一段在视频里开始的秒数——上面这条视频的段落从 0、170、340 秒开始。
on_screen
按关键帧取帧读出画面上的字,每条带它出现的大致时间(≈,误差在一个关键帧间隔内);连续相同的字合成一条。 要按秒定位某句话,用这个字段。
用法
一条 curl,或一行 MCP
curl -X POST https://linkdigest.dev/api/v1/digest \
-H "Authorization: Bearer ld_live_..." \
-H "Content-Type: application/json" \
-d '{"url": "https://v.douyin.com/VeXgdE_QwTE", "format": "json"}'这条链接是首页示例之一,已经被读过并缓存,所以会直接返回 200, 不扣额度。换成你自己的链接:图文和短帖直接返回;需要下载并转写的视频返回 202 和一个 jobId,用同一个 key 去 GET /api/v1/digest/JOB_ID 取结果。
# 返回 202 时:用同一个 Key 取结果,每次最多等 20 秒 curl "https://linkdigest.dev/api/v1/digest/JOB_ID?wait=20" -H "Authorization: Bearer ld_live_..."
MCP · Claude Code(Cursor、Trae、Cherry Studio、通义灵码见文档)
claude mcp add --transport http linkdigest \ https://linkdigest.dev/mcp \ --header "Authorization: Bearer ld_live_..."
API Key 在 https://linkdigest.dev/app/keys 创建(形如 ld_live_…)。 REST、MCP 各客户端的配置、轮询和返回字段见 中文 API / MCP 文档。
价格
按分钟计费,折合人民币
视频是 1 个基础积分,加上每开始的 1 分钟 1 积分。
| 一条内容 | 积分 | 折合人民币 |
|---|---|---|
| 抖音图文(6 张图以内) | 1 | ¥0.144 |
| 30 秒视频 | 2 | ¥0.288 |
| 1 分钟视频 | 2 | ¥0.288 |
| 3 分钟视频 | 4 | ¥0.576 |
| 10 分钟视频 | 11 | ¥1.584 |
| 1 分钟视频 + 爆款拆解 | 3 | ¥0.432 |
按加量包折算:$5 = 250 积分,支付宝按人民币结算 ¥36,每积分 ¥0.144。注册送 10 积分(一次性)。 任何人读过的链接再读 0 积分;读不出内容不收费。
只要逐字稿的话,有更便宜的做法。2026-10-03 的调研里:硅基流动有标价为免费的语音识别模型 (siliconflow.cn/pricing),通义听悟 API 是 ¥0.6/小时 (阿里云帮助中心), 社媒数据助手的视频提取文案是 ¥0.10/分钟(socialdatax.com/pricing)。 LinkDigest 的 1 分钟视频是 ¥0.288,贵在同一个 JSON 里还有画面文字、图文 OCR、互动数据和可选的拆解,并且不用你自己处理抖音的访问。 完整对比见 对比页。
做不到的
接之前先看这几条
- 不提供视频文件、不去水印。只返回文本。
- 逐字稿没有逐句时间(见上),需要逐句时间轴的场景要自己再对齐。
- 一次读一条链接:不做关键词搜索,不抓评论区,不按账号批量抓主页。
- 抖音那条路依赖我们的会话,会话过期期间可能读不出来;状态见 GET /api/v1/health/platforms。读不出内容的不收费。
| 平台 / 类型 | 原因 |
|---|---|
| B站(哔哩哔哩) | 对我们服务器的地址直接返回 HTTP 412,请求到不了视频。需要代理,目前没有。 |
| X 长文(Articles) | 只能拿到首图。普通帖子的图片、视频都能读,长文正文读不到。 |
| 代码已接入,但没有端到端验证过,所以不算支持。 |
常见问题
会被问到的
- 逐字稿有时间戳吗?
- 有,但要说准确:没有平台字幕时,逐字稿来自语音识别 Qwen3-ASR。它只返回文字、不返回逐句时间,所以 transcript 按段给:每段最长约 170 秒,t 是这一段在视频里开始的秒数。要按秒定位,看 on_screen(画面里的字,带 ≈ 时间,误差在一个关键帧间隔内)。
- 转写用的什么?
- 抖音不发布字幕,所以用语音识别 Qwen3-ASR。2026-09-18 我们用同一批中文视频对比过 Whisper large-v3-turbo:它更快更便宜,但中文错得更多(把「900人」听成「酒派人」、「创业」听成「创意」),所以生产环境用 Qwen3-ASR。
- 长视频怎么办?
- 需要下载并转写的视频,POST 返回 202 和 jobId,用 GET /api/v1/digest/{jobId}?wait=20 取结果,没完成就再取一次(MCP 里是再调一次 digest_url,只传 job_id)。免费计划单条视频最长 10 分钟,Dev 计划 30 分钟;更长的视频带 partial_ok: true 可以只读开头、按读了多少计费。
- 能去水印下载视频吗?
- 不能,也不做。只返回文本,视频在临时目录里处理,请求返回前删除。
- 需要我登录抖音或给 cookie 吗?
- 不需要。抖音拒绝匿名请求,所以这条路跑在我们自己的会话上;会话过期由我们续。各平台最近一次验证时间可以直接读 GET /api/v1/health/platforms,不需要 Key。
不用注册先试一条;注册送 10 积分,不用绑卡。支持的平台上有链接读不出来,就是一个值得报告的 bug。