Openai Whisper API

Transcribe audio using OpenAI's Whisper API (cloud-based, no local model needed). Use when this capability is needed.

tomevault-io Updated

File contents

OpenAI Whisper API

Cloud-based audio transcription via OpenAI's API.

Transcribe Audio

curl -s "https://api.openai.com/v1/audio/transcriptions" \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -F file="@audio.mp3" \
  -F model="whisper-1" | jq '.text'

With Timestamps

curl -s "https://api.openai.com/v1/audio/transcriptions" \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -F file="@audio.mp3" \
  -F model="whisper-1" \
  -F response_format="verbose_json" \
  -F timestamp_granularities[]="segment" | jq '.segments[] | {start, end, text}'

Translate to English

curl -s "https://api.openai.com/v1/audio/translations" \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -F file="@foreign-audio.mp3" \
  -F model="whisper-1" | jq '.text'

Converted and distributed by TomeVault — claim your Tome and manage your conversions.

tomevault-io/skills-registry/tree/main/kody-w--openrappter--openai-whisper-api commit b163df0938

Frequently asked questions

npx skillmds@latest add tomevault-io/openai-whisper-api-14