Openai Whisper API

Transcribe audio via OpenAI Audio Transcriptions API (Whisper).

ahang1598 Updated 9 repo stars

File contents

OpenAI Whisper API (curl)

Transcribe an audio file via OpenAI's /v1/audio/transcriptions endpoint.

Quick start

{baseDir}/scripts/transcribe.sh /path/to/audio.m4a

Defaults:

  • Model: whisper-1
  • Output: <input>.txt

Useful flags

{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model whisper-1 --out /tmp/transcript.txt
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --language en
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --prompt "Speaker names: Peter, Daniel"
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --json --out /tmp/transcript.json

API key

Set OPENAI_API_KEY environment variable.

ahang1598/doubao-workbuddy-qwenwork-skills/tree/main/workbuddy/official_experts/plugins/hot-skills/skills/openai-whisper-api commit ff37852316

Frequently asked questions

npx skillmds@latest add ahang1598/openai-whisper-api