Elevenlabs Stt

ElevenLabs speech-to-text with Scribe models and forced alignment via inference.sh CLI. Models: Scribe v1/v2 (98%+ accuracy, 90+ languages). Capabilities: transcription, speaker diarization, audio event tagging, word-level timestamps, forced alignment, subtitle generation. Use for: meeting transcription, subtitles, podcast transcripts, lip-sync timing, karaoke. Triggers: elevenlabs stt, elevenlabs transcription, scribe, elevenlabs speech to text, forced alignment, word alignment, subtitle timing, diarization, speaker identification, audio event detection, eleven labs transcribe

VRIL-LABS Updated

File contents

VRIL-LABS/skill-jam/tree/main/skills/ai-ml/skills-main/skills-main/tools/audio/elevenlabs-stt commit 3e098932b7

Frequently asked questions

npx skillmds@latest add vril-labs/elevenlabs-stt