{"slug":"social-transcript-extractor","title":"Social Transcript Extractor — SupaData API","tags":["transcript","social-media","youtube","tiktok","instagram","competitor-research"],"agent_summary":"Extract video transcripts from YouTube, Instagram, TikTok, Twitter/X, and Facebook using the SupaData API. Use for competitor ad research, voice profiling, and content repurposing.","trigger_phrases":["social transcript","instagram transcript","tiktok transcript","x transcript","extract transcript","pull video script","competitor ad script","supadata api"],"runnable":true,"markdown":"\n# Social Transcript Extractor — SupaData API\n\nExtract transcripts from video content across all major social platforms via SupaData. Primary use: competitor ad research and content repurposing.\n\n## Supported Platforms\n\n- YouTube\n- Instagram (Reels, IGTV, Stories)\n- TikTok\n- Twitter/X (video tweets)\n- Facebook (video posts)\n\n## Auth & Setup\n\nAPI key: `D:\\Ecosystem\\secrets\\MASTER_API_KEYS.env` → `SUPADATA_API_KEY`\n\nDashboard: https://dash.supadata.ai\n\nPricing: Free tier = 100 credits/mo | Pro = $17/mo for 3,000 credits\n\n## Basic Extraction\n\n```bash\ncurl -X GET \"https://api.supadata.ai/v1/transcript?url=VIDEO_URL&text=true\" \\\n  -H \"x-api-key: $SUPADATA_API_KEY\"\n```\n\n| Parameter | Required | Description |\n|-----------|----------|-------------|\n| url | Yes | Full video URL |\n| text | No | Return plain text instead of timestamped JSON |\n| lang | No | Language code (default: auto-detect) |\n\n## Python Extraction\n\n```python\nimport os\nimport requests\n\ndef extract_transcript(video_url):\n    response = requests.get(\n        \"https://api.supadata.ai/v1/transcript\",\n        params={\"url\": video_url, \"text\": \"true\"},\n        headers={\"x-api-key\": os.environ[\"SUPADATA_API_KEY\"]}\n    )\n    data = response.json()\n    return data.get(\"content\", \"\")\n\n# Competitor TikTok\ntranscript = extract_transcript(\"https://www.tiktok.com/@competitor/video/123456\")\nprint(transcript)\n```\n\n## Response Format\n\n```json\n{\n  \"content\": \"Full transcript text...\",\n  \"lang\": \"en\",\n  \"availableLangs\": [\"en\", \"es\"],\n  \"wordCount\": 312\n}\n```\n\n## Workflow: Competitor Ad Research\n\n1. Find competitor video via TikTok/Instagram/YouTube search\n2. Extract transcript with this skill\n3. Analyze hook structure, pacing, CTAs\n4. Feed into [[scriptwriter]] as reference for new scripts\n5. Identify winning angles for [[ai-video-pipeline]]\n\n## Workflow: Content Repurposing\n\n1. Extract transcript from Mike's or client's existing video\n2. Clean up with Claude\n3. Use as blog post body or email newsletter\n4. Add to PAA content engine for keyword optimization\n\n## Proxy Rule\n\nInstagram and TikTok extraction must use proxies — do not pull from home IP.\n\nRead proxy config from `D:\\Ecosystem\\secrets\\MASTER_API_KEYS.env` (PROXY_1).\n\n```python\nproxies = {\n    \"http\": f\"http://{user}:{password}@{host}:{port}\",\n    \"https\": f\"http://{user}:{password}@{host}:{port}\"\n}\nresponse = requests.get(url, params=params, headers=headers, proxies=proxies)\n```\n\n## Related Topics\n\n- [[assemblyai-transcription]] — transcribe audio files (not social URLs)\n- [[ytdlp-agent]] — download YouTube videos and subtitles directly\n- [[yt-transcript-pipeline]] — automated YouTube transcript vault\n\n#video-sop #transcript #social-media #youtube #tiktok #instagram #competitor-research\n","html":"<h1>Social Transcript Extractor — SupaData API</h1>\n<p>Extract transcripts from video content across all major social platforms via SupaData. Primary use: competitor ad research and content repurposing.</p>\n<h2>Supported Platforms</h2>\n<ul>\n<li>YouTube</li>\n<li>Instagram (Reels, IGTV, Stories)</li>\n<li>TikTok</li>\n<li>Twitter/X (video tweets)</li>\n<li>Facebook (video posts)</li>\n</ul>\n<h2>Auth &#x26; Setup</h2>\n<p>API key: <code>D:\\Ecosystem\\secrets\\MASTER_API_KEYS.env</code> → <code>SUPADATA_API_KEY</code></p>\n<p>Dashboard: https://dash.supadata.ai</p>\n<p>Pricing: Free tier = 100 credits/mo | Pro = $17/mo for 3,000 credits</p>\n<h2>Basic Extraction</h2>\n<pre><code class=\"language-bash\">curl -X GET \"https://api.supadata.ai/v1/transcript?url=VIDEO_URL&#x26;text=true\" \\\n  -H \"x-api-key: $SUPADATA_API_KEY\"\n</code></pre>\n<p>| Parameter | Required | Description |\n|-----------|----------|-------------|\n| url | Yes | Full video URL |\n| text | No | Return plain text instead of timestamped JSON |\n| lang | No | Language code (default: auto-detect) |</p>\n<h2>Python Extraction</h2>\n<pre><code class=\"language-python\">import os\nimport requests\n\ndef extract_transcript(video_url):\n    response = requests.get(\n        \"https://api.supadata.ai/v1/transcript\",\n        params={\"url\": video_url, \"text\": \"true\"},\n        headers={\"x-api-key\": os.environ[\"SUPADATA_API_KEY\"]}\n    )\n    data = response.json()\n    return data.get(\"content\", \"\")\n\n# Competitor TikTok\ntranscript = extract_transcript(\"https://www.tiktok.com/@competitor/video/123456\")\nprint(transcript)\n</code></pre>\n<h2>Response Format</h2>\n<pre><code class=\"language-json\">{\n  \"content\": \"Full transcript text...\",\n  \"lang\": \"en\",\n  \"availableLangs\": [\"en\", \"es\"],\n  \"wordCount\": 312\n}\n</code></pre>\n<h2>Workflow: Competitor Ad Research</h2>\n<ol>\n<li>Find competitor video via TikTok/Instagram/YouTube search</li>\n<li>Extract transcript with this skill</li>\n<li>Analyze hook structure, pacing, CTAs</li>\n<li>Feed into [[scriptwriter]] as reference for new scripts</li>\n<li>Identify winning angles for [[ai-video-pipeline]]</li>\n</ol>\n<h2>Workflow: Content Repurposing</h2>\n<ol>\n<li>Extract transcript from Mike's or client's existing video</li>\n<li>Clean up with Claude</li>\n<li>Use as blog post body or email newsletter</li>\n<li>Add to PAA content engine for keyword optimization</li>\n</ol>\n<h2>Proxy Rule</h2>\n<p>Instagram and TikTok extraction must use proxies — do not pull from home IP.</p>\n<p>Read proxy config from <code>D:\\Ecosystem\\secrets\\MASTER_API_KEYS.env</code> (PROXY_1).</p>\n<pre><code class=\"language-python\">proxies = {\n    \"http\": f\"http://{user}:{password}@{host}:{port}\",\n    \"https\": f\"http://{user}:{password}@{host}:{port}\"\n}\nresponse = requests.get(url, params=params, headers=headers, proxies=proxies)\n</code></pre>\n<h2>Related Topics</h2>\n<ul>\n<li>[[assemblyai-transcription]] — transcribe audio files (not social URLs)</li>\n<li>[[ytdlp-agent]] — download YouTube videos and subtitles directly</li>\n<li>[[yt-transcript-pipeline]] — automated YouTube transcript vault</li>\n</ul>\n<p>#video-sop #transcript #social-media #youtube #tiktok #instagram #competitor-research</p>\n"}