Openai Whisper Api

Transcribe audio via OpenAI Audio Transcriptions API (Whisper).

Peter Steinberger

@steipete

What This Skill Does

Transcribes audio files to text using OpenAI's Whisper API. Supports multiple input formats, language hints, and optional JSON output.

Replaces manual transcription services or building a custom integration with OpenAI's speech-to-text endpoint.

When to Use It

  • Transcribe a recorded meeting or lecture to text
  • Generate subtitles or captions from an audio file
  • Convert voice memos into written notes
  • Extract spoken content from a podcast episode
  • Create a text transcript of an interview recording

Install

$ openclaw skills install @steipete/openai-whisper-api

OpenAI Whisper API (curl)

Transcribe an audio file via OpenAI’s /v1/audio/transcriptions endpoint.

Quick start

{baseDir}/scripts/transcribe.sh /path/to/audio.m4a

Defaults:

  • Model: whisper-1
  • Output: <input>.txt

Useful flags

{baseDir}/scripts/transcribe.sh /path/to/audio.ogg --model whisper-1 --out /tmp/transcript.txt
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --language en
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --prompt "Speaker names: Peter, Daniel"
{baseDir}/scripts/transcribe.sh /path/to/audio.m4a --json --out /tmp/transcript.json

API key

Set OPENAI_API_KEY, or configure it in ~/.clawdbot/clawdbot.json:

{
  skills: {
    "openai-whisper-api": {
      apiKey: "OPENAI_KEY_HERE"
    }
  }
}

Top skills in this category