Use
openai/gpt-4o-transcribe for transcription and openai/gpt-4o-mini-tts for speech
generation.Speech to Text
from dedalus_labs import AsyncDedalus
client = AsyncDedalus()
with open("audio.mp3", "rb") as audio_file:
transcription = await client.audio.transcriptions.create(
model="openai/gpt-4o-transcribe",
file=audio_file,
)
print(transcription.text)
import Dedalus from "dedalus-labs";
import fs from "node:fs";
const client = new Dedalus();
const transcription = await client.audio.transcriptions.create({
model: "openai/gpt-4o-transcribe",
file: fs.createReadStream("audio.mp3"),
});
console.log(transcription.text);
Audio Translation
from dedalus_labs import AsyncDedalus
client = AsyncDedalus()
with open("spanish-audio.mp3", "rb") as audio_file:
translation = await client.audio.translations.create(
model="openai/gpt-4o-mini-transcribe",
file=audio_file,
)
print(translation.text)
import Dedalus from "dedalus-labs";
import fs from "node:fs";
const client = new Dedalus();
const translation = await client.audio.translations.create({
model: "openai/gpt-4o-mini-transcribe",
file: fs.createReadStream("spanish-audio.mp3"),
});
console.log(translation.text);
Text to Speech
from dedalus_labs import AsyncDedalus
client = AsyncDedalus()
speech = await client.audio.speech.create(
model="openai/gpt-4o-mini-tts",
voice="alloy",
input="Hello from Dedalus",
)
speech.stream_to_file("speech.mp3")
import Dedalus from "dedalus-labs";
import fs from "node:fs";
const client = new Dedalus();
const response = await client.audio.speech.create({
model: "openai/gpt-4o-mini-tts",
voice: "alloy",
input: "Hello from Dedalus",
});
fs.writeFileSync("speech.mp3", Buffer.from(await response.arrayBuffer()));
API endpoints
Speech
POST /v1/audio/speech
Transcriptions
POST /v1/audio/transcriptions
Translations
POST /v1/audio/translations
