For the complete documentation index, see llms.txt. This page is also available as Markdown.

Audio Transcription

Transcription converts spoken audio into written text, enabling applications such as speech-to-text, meeting notes, subtitles, and voice analytics. It supports multiple audio formats and languages, making it easy to extract accurate text from audio content.

To get a full list of embedding models visit cortecs.ai and filter by the Transcription tag.

from openai import OpenAI

client = OpenAI(
    base_url="https://api.cortecs.ai/v1/audio/transcriptions",
    api_key="<API_KEY>",
)

with open("audio_file.wav", "rb") as audio_file:
    response = client.audio.transcriptions.create(
        file=audio_file,
        model="<MODEL_NAME>"
    )

print(response)
import fs from 'fs';

const filepath = 'audio_file.wav';

const formData = new FormData();
formData.append('file', new Blob([fs.readFileSync(filepath)]), 'audio_file.wav');
formData.append('model', '<MODEL_NAME>');

const response = await fetch('https://api.cortecs.ai/v1/audio/transcriptions', {
  method: 'POST',
  headers: {
    Authorization: 'Bearer <API_KEY>',
  },
  body: formData,
});

const data = await response.json();
console.log(data);

Note: File format support depends on the provider. Check the model documentation for details.

Last updated