Elevenlabs Stt

ElevenLabs speech-to-text with Scribe models and forced alignment via inference.sh CLI. Models: Scribe v1/v2 (98%+ accuracy, 90+ languages). Capabilities: transcription, speaker diarization, audio event tagging, word-level timestamps, forced alignment, subtitle generation. Use for: meeting transcription, subtitles, podcast transcripts, lip-sync timing, karaoke. Triggers: elevenlabs stt, elevenlabs transcription, scribe, elevenlabs speech to text, forced alignment, word alignment, subtitle timing, diarization, speaker identification, audio event detection, eleven labs transcribe

matrixy Updated

File contents

matrixy/inference.sh-skills/tree/main/tools/audio/elevenlabs-stt commit 6c5e75f6f0

Frequently asked questions

npx skillmds@latest add matrixy/elevenlabs-stt