~/social/tiktok-transcript-scraper

TikTok 자막·스크립트 스크레이퍼 — JSON, SRT, VTT, LLM

영상 URL, 단축 링크, @프로필 전체에서 TikTok 자막과 스크립트를 추출해 JSON, SRT, VTT, 일반 텍스트, LLM용 텍스트로 제공합니다. 네이티브 자막을 그대로 가져오므로 Whisper도 API 키도 필요 없고, 영상당 약 2초입니다.

미디어 TypeScript 글로벌
proooxy/tiktok-transcript-scraper — 사양
카테고리social / 미디어
언어TypeScript
스택TypeScript
마켓글로벌
출력클린한 RAG-레디 JSON

주요 기능

음성을 다시 인식하지 않고 TikTok 자체 자막을 읽어 영상당 약 2초 — Whisper 방식은 보통 10~30초

화면에 보이는 문장 그대로라 잘못 듣거나 없는 말을 만들어내지 않습니다

다섯 가지 출력 형식 — 타임스탬프 JSON, SRT, VTT, 일반 텍스트, [Music]과 화자 라벨을 제거한 LLM용 텍스트

입력 한 칸에 영상 URL, vm./vt. 단축 링크, @사용자명, 원시 영상 ID를 섞어 넣을 수 있습니다

프로필을 넣으면 해당 크리에이터의 영상을 나열하며, maxVideos가 실행 전체의 예산이 됩니다

영상별 참여 지표 — 재생, 좋아요, 댓글, 공유, 길이, 단어 수, 구간 수

자막 언어 우선순위 목록과 접두어 매칭(eng가 eng-US에 매칭), 자동 생성 자막 사용 여부 설정

추출 실패, 단축 링크 해석, 프로필 나열에는 요금이 부과되지 않습니다

활용 사례

  • 숏폼 영상으로 RAG·파인튜닝용 코퍼스 구축
  • 말로 전달된 내용을 블로그, 뉴스레터, SNS 카피로 재활용
  • 특정 분야 크리에이터 전반의 콘텐츠 경쟁 분석
  • 재게시와 현지화를 위한 SRT/VTT 자막 파일 생성
  • 후킹 연구 — 상위 영상의 도입부 몇 초를 한꺼번에 읽기
  • 협찬 게시물의 브랜드 안전성과 표기 점검을 대규모로 수행

입력 파라미터

파라미터타입필수설명
urlsarray필수TikTok 영상 URL, 단축 링크, @사용자명 또는 원시 영상 ID
outputFormatstring선택json, srt, vtt, text, llm
languagesarray선택선호 자막 언어를 우선순위로 지정. 접두어 매칭을 지원해 eng가 eng-US에 매칭됩니다
includeAutoGeneratedboolean선택수동 자막이 없을 때 TikTok 자동 생성 자막을 포함할지 여부
maxVideosinteger선택실행 전체에서 처리할 영상 수 상한. 0은 무제한
maxConcurrencyinteger선택동시 처리 수 1~10. 낮을수록 속도 제한에 안전합니다
proxyConfigurationobject선택주거용 프록시를 강력히 권장 — TikTok은 데이터센터 IP를 적극적으로 차단합니다

출력 예시

 1{
 2  "videoId": "7627209981670001950",
 3  "url": "https://www.tiktok.com/@tiktok/video/7627209981670001950",
 4  "title": "your TikTok grandpa @writers cramp is proud of you",
 5  "authorName": "TikTok",
 6  "authorId": "tiktok",
 7  "createTime": "2026-04-10T19:10:35.000Z",
 8  "playCount": 54600,
 9  "likeCount": 3656,
10  "commentCount": 837,
11  "shareCount": 291,
12  "availableLanguages": ["eng-US"],
13  "language": "eng-US",
14  "isAutoGenerated": true,
15  "segments": [
16    { "text": "I'm 81 years old and I'm known as the TikTok Grandpa", "start": 0.04, "end": 3.64 },
17    { "text": "my name is Ian Smith", "start": 3.641, "end": 4.721 }
18  ],
19  "text": "I'm 81 years old and I'm known as the TikTok Grandpa my name is Ian Smith...",
20  "duration": 77,
21  "wordCount": 243,
22  "segmentCount": 29,
23  "extractedAt": "2026-04-12T02:45:36.000Z",
24  "error": null
25}

팁

영상 하나로 시작하세요. URL 하나면 프로필 실행 전에 스키마와 반환되는 자막 언어를 확인할 수 있습니다. 프로필 실행에는 maxVideos를 설정하세요. 프로필별이 아니라 실행 전체 예산이라 혼합 입력에서도 초과하지 않습니다. 동시 처리 수는 3으로 두세요. TikTok의 속도 제한이 엄격해 값을 올리면 안정성만 잃습니다. AI 파이프라인에는 llm 형식. [Music], 화자 라벨, 주석을 제거해 임베딩 노이즈를 줄입니다.

자주 묻는 질문

Whisper나 음성 인식을 사용하나요?
아닙니다. TikTok이 직접 생성해 CDN으로 제공하는 자막 파일을 가져옵니다. 그래서 시청자가 보는 문장과 정확히 같고, 영상당 30초가 아니라 약 2초가 걸립니다.
자막이 없는 영상은 어떻게 되나요?
error 필드가 채워진 레코드로 반환되며 요금이 발생하지 않습니다. 과금은 제출한 URL 수가 아니라 성공적으로 추출된 스크립트 수를 기준으로 합니다.
계정 전체를 수집할 수 있나요?
가능합니다. 프로필 URL이나 @사용자명을 넣으면 해당 크리에이터의 영상을 나열합니다. maxVideos로 상한을 두세요. 직접 지정한 영상이 먼저 처리되고 남은 예산을 프로필이 채웁니다.

~/social 관련 도구

TikTok 자막·스크립트 스크레이퍼 — JSON, SRT, VTT, LLM 실행하기, 또는 맞춤 제작 요청

몇 분 안에 Apify에서 추출을 시작하거나, 원하는 소스와 스키마에 딱 맞는 맞춤 스크래퍼와 RAG 파이프라인 제작을 의뢰하세요.

Apify에서 실행 맞춤 데이터 요청