~/social/tiktok-transcript-scraper

TikTok 字幕与转录爬虫——JSON、SRT、VTT、LLM

从视频链接、短链或整个 @账号 提取 TikTok 字幕与转录文本,输出 JSON、SRT、VTT、纯文本或适配大模型的清洗文本。直接取原生字幕——不用 Whisper,不需要 API key,单条视频约两秒。

媒体 TypeScript 全球
proooxy/tiktok-transcript-scraper — 规格
分类social / 媒体
语言TypeScript
技术栈TypeScript
市场全球
输出干净、RAG 就绪的 JSON

核心特性

直接读取 TikTok 自带字幕,而非重新转录音频——单条视频约 2 秒,Whisper 方案通常要 10–30 秒

文本与屏幕上显示的完全一致,不会听错也不会杜撰

五种输出格式——带时间戳的 JSON、SRT、VTT、纯文本,以及剔除 [Music] 与说话人标记的大模型就绪文本

一个输入字段同时接受视频链接、vm./vt. 短链、@用户名 与纯视频 ID,可混合填写

传入账号即可枚举该创作者的视频,maxVideos 作为整次运行的总预算

每条视频附带互动数据——播放、点赞、评论、分享、时长、词数、分段数

按优先级设置字幕语言,支持前缀匹配(eng 可匹配 eng-US),并可开关自动生成字幕

提取失败、短链解析与账号枚举一律不计费

应用场景

  • 用短视频内容构建 RAG 或微调语料
  • 把口播内容改写成博客、邮件通讯与社媒文案
  • 对某个赛道的全部创作者做内容竞品分析
  • 生成 SRT/VTT 字幕文件用于二次发布与本地化
  • 开头钩子研究——批量读取头部视频的前几秒文案
  • 对带货/广告内容做品牌安全与合规审查

输入参数

参数类型必填说明
urlsarray必填TikTok 视频链接、短链、@用户名 或纯视频 ID
outputFormatstring可选json、srt、vtt、text 或 llm
languagesarray可选字幕语言优先级列表;支持前缀匹配,eng 可匹配 eng-US
includeAutoGeneratedboolean可选当没有人工字幕时,是否包含 TikTok 自动生成的字幕
maxVideosinteger可选整次运行处理的视频数上限;0 表示不限
maxConcurrencyinteger可选并发数 1–10;数值越低越不容易触发限流
proxyConfigurationobject可选强烈建议使用住宅代理——TikTok 对机房 IP 封锁严格

输出示例

 1{
 2  "videoId": "7627209981670001950",
 3  "url": "https://www.tiktok.com/@tiktok/video/7627209981670001950",
 4  "title": "your TikTok grandpa @writers cramp is proud of you",
 5  "authorName": "TikTok",
 6  "authorId": "tiktok",
 7  "createTime": "2026-04-10T19:10:35.000Z",
 8  "playCount": 54600,
 9  "likeCount": 3656,
10  "commentCount": 837,
11  "shareCount": 291,
12  "availableLanguages": ["eng-US"],
13  "language": "eng-US",
14  "isAutoGenerated": true,
15  "segments": [
16    { "text": "I'm 81 years old and I'm known as the TikTok Grandpa", "start": 0.04, "end": 3.64 },
17    { "text": "my name is Ian Smith", "start": 3.641, "end": 4.721 }
18  ],
19  "text": "I'm 81 years old and I'm known as the TikTok Grandpa my name is Ian Smith...",
20  "duration": 77,
21  "wordCount": 243,
22  "segmentCount": 29,
23  "extractedAt": "2026-04-12T02:45:36.000Z",
24  "error": null
25}

使用建议

先跑单条视频。 一个链接就能确认 schema 和返回的字幕语言,再去跑整个账号。 账号抓取务必设置 maxVideos。 它是整次运行的总预算而非每个账号的上限,混合输入也不会超量。 并发保持 3。 TikTok 限流很严,调高只是用稳定性换一点速度。 喂给大模型就选 llm 格式。 该格式会剔除 [Music]、说话人标记与注释,否则这些在向量化时都是噪声。

常见问题

这个 Actor 用的是 Whisper 或语音识别吗?
不是。它直接取 TikTok 自己生成、并由其 CDN 分发的字幕文件,所以文本与观众看到的完全一致,单条视频约两秒即可完成,而不是半分钟。
视频没有字幕会怎样?
会返回一条带 error 字段的记录,且不计费。计费按成功提取的转录条数,而不是按提交的链接数。
可以抓取整个账号吗?
可以——传入账号主页链接或 @用户名,Actor 会枚举该创作者的视频。用 maxVideos 控制规模;明确指定的视频优先处理,剩余预算再分给账号。

~/social 下的相关工具

运行 TikTok 字幕与转录爬虫——JSON、SRT、VTT、LLM,或定制专属方案

几分钟内即可在 Apify 上开始提取数据,或聘请我为你的目标源和 schema 定制专属爬虫与 RAG 管道。

在 Apify 上运行 获取定制数据