Guides Imọlẹ Parcours78 / 88
Modèle · Audio

GPT 4o Mini TTS

Texte vers parole OpenAI pour voix d’application, narration et audio produit.

Identifiant du modèlegpt-4o-mini-tts
Route API POST /audio/speech
Tester dans le Laboratoire
Présentation du modèle

Ce que fait ce modèle

GPT 4o Mini TTS est conçu pour une interprétation naturelle et contrôlée où ton, émotion et performance comptent.

Cette page rassemble la description du modèle, les réglages exposés par Imọlẹ et les informations nécessaires pour l’appeler avec l’API.

Capacités

Résultats et opérations pris en charge

  • Narration, voix produit, audio éducatif, publicité et voix off soignée.
Demande

Décrire clairement le résultat attendu

Construisez la demande dans cet ordre. Chaque étape précise une information que le modèle peut utiliser directement.

  1. 01

    Texte

    Écrivez pour l’oreille : phrases courtes, ponctuation naturelle et prononciation explicite si nécessaire.

  2. 02

    Interprète

    Choisissez une voix ou une référence adaptée au public, à l’âge, à l’accent et à l’usage.

  3. 03

    Interprétation

    Décrivez concrètement le ton, le rythme, l’énergie, l’émotion, les pauses et l’accentuation.

  4. 04

    Sortie

    Choisissez un format adapté au montage, au streaming, à la téléphonie ou à la livraison finale.

Exemple 1

Narration de marque

Texte : « Votre idée mérite plus qu’une démo. Créez-la, testez-la et partagez-la. » Interprétation : chaleureuse et assurée, conversationnelle plutôt que théâtrale, rythme moyen, courte pause après « démo », légère emphase sur « créez-la », prononciation française claire, sourire non exagéré.

La direction utilise des choix audibles et concrets plutôt que de simples adjectifs vagues.

Réglages

Contrôles disponibles dans Imọlẹ

Voix

Choisissez une voix dont le registre naturel correspond déjà au rôle demandé.

Vitesse

Commencez à 1,0. Modifiez la vitesse seulement après avoir rendu ponctuation et longueur des phrases naturelles.

Format de sortie

Utilisez WAV/PCM pour le montage ou une lecture à faible latence et un format compressé pour la livraison et le stockage.

API

Intégrer le modèle dans un projet

MéthodePOST
Chemin/audio/speech
URL de basehttps://api.imole.app/v1
Coût API4 cauris
AuthorizationBearer $IMOLE_API_KEY
Content-TypeUtilisez application/json pour les requêtes JSON.

Chargez IMOLE_API_KEY depuis une variable d’environnement côté serveur. N’insérez jamais la clé dans le code envoyé au navigateur, une application mobile, un dépôt Git ou un fichier partagé.

Corps de requête

Paramètres acceptés

ParamètreDescriptionValeurs
modelRequis

Utilisez gpt-4o-mini-tts.

inputRequis

Texte à synthétiser.

voiceRequis

Voix intégrée.

alloy, ash, ballad, coral, echo, fable, onyx, nova, sage, shimmer, verse, marin, cedar
response_format

Format de sortie audio.

mp3, opus, aac, flac, wav, pcm
instructions

Instructions d’interprétation pour le ton, le rythme et le style.

speed

Multiplicateur de vitesse vocale.

0.25-4.0
Code

Exemples d’intégration

Testez d’abord la requête cURL, puis reprenez le même identifiant de modèle dans votre application JavaScript ou Python.

Synthèse vocale simple

curl -X POST "https://api.imole.app/v1/audio/speech" \
  -H "Authorization: Bearer $IMOLE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gpt-4o-mini-tts",
  "input": "Welcome to Imole.",
  "voice": "alloy",
  "response_format": "mp3"
}' \
  --output gpt-4o-mini-tts.mp3

Interprétation dirigée

curl -X POST "https://api.imole.app/v1/audio/speech" \
  -H "Authorization: Bearer $IMOLE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gpt-4o-mini-tts",
  "input": "Bonjour. Bienvenue sur Imole.",
  "voice": "alloy",
  "response_format": "mp3",
  "instructions": "Warm, clear, and confident. Medium pace.",
  "speed": 1.05
}' \
  --output gpt-4o-mini-tts-directed.mp3

Autre voix et autre format

curl -X POST "https://api.imole.app/v1/audio/speech" \
  -H "Authorization: Bearer $IMOLE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gpt-4o-mini-tts",
  "input": "Imole confirms your request.",
  "voice": "sage",
  "response_format": "wav",
  "speed": 0.95
}' \
  --output gpt-4o-mini-tts-sage.wav
Production

Réponse, suivi et erreurs

La route renvoie un fichier ou un objet JSON selon l’opération. Contrôlez le statut HTTP et le type de contenu avant de stocker la réponse.

400

Requête incorrecte : corrigez le champ indiqué avant de réessayer.

401

Clé absente, incorrecte ou révoquée.

402

Solde de cauris insuffisant.

429

Capacité temporairement indisponible : respectez `Retry-After` et utilisez un délai progressif.

5xx

Erreur temporaire : conservez l’identifiant de requête et évitez de relancer deux fois une opération facturable.

Cauris

Tarification et sources

Coût affiché4 cauris

Le coût exact dépend du modèle et, pour certains médias, de la durée, de la résolution ou de la qualité.

Documentation de référenceGuide de synthèse vocale d’OpenAI