Guides Imọlẹ Parcours76 / 88
Modèle · Audio

MAI Voice 2

Texte vers parole Azure Speech pour narration et sortie vocale avec voix sélectionnables.

Identifiant du modèlemai-voice-2
Route API POST /audio/speech
Tester dans le Laboratoire
Présentation du modèle

Ce que fait ce modèle

MAI Voice 2 est conçu pour une interprétation naturelle et contrôlée où ton, émotion et performance comptent.

Cette page rassemble la description du modèle, les réglages exposés par Imọlẹ et les informations nécessaires pour l’appeler avec l’API.

Capacités

Résultats et opérations pris en charge

  • Narration, voix produit, audio éducatif, publicité et voix off soignée.
Demande

Décrire clairement le résultat attendu

Construisez la demande dans cet ordre. Chaque étape précise une information que le modèle peut utiliser directement.

  1. 01

    Texte

    Écrivez pour l’oreille : phrases courtes, ponctuation naturelle et prononciation explicite si nécessaire.

  2. 02

    Interprète

    Choisissez une voix ou une référence adaptée au public, à l’âge, à l’accent et à l’usage.

  3. 03

    Interprétation

    Décrivez concrètement le ton, le rythme, l’énergie, l’émotion, les pauses et l’accentuation.

  4. 04

    Sortie

    Choisissez un format adapté au montage, au streaming, à la téléphonie ou à la livraison finale.

Exemple 1

Narration de marque

Texte : « Votre idée mérite plus qu’une démo. Créez-la, testez-la et partagez-la. » Interprétation : chaleureuse et assurée, conversationnelle plutôt que théâtrale, rythme moyen, courte pause après « démo », légère emphase sur « créez-la », prononciation française claire, sourire non exagéré.

La direction utilise des choix audibles et concrets plutôt que de simples adjectifs vagues.

Réglages

Contrôles disponibles dans Imọlẹ

Voix

Choisissez une voix dont le registre naturel correspond déjà au rôle demandé.

Vitesse

Commencez à 1,0. Modifiez la vitesse seulement après avoir rendu ponctuation et longueur des phrases naturelles.

Format de sortie

Utilisez WAV/PCM pour le montage ou une lecture à faible latence et un format compressé pour la livraison et le stockage.

API

Intégrer le modèle dans un projet

MéthodePOST
Chemin/audio/speech
URL de basehttps://api.imole.app/v1
Coût API5 cauris
AuthorizationBearer $IMOLE_API_KEY
Content-TypeUtilisez application/json pour les requêtes JSON.

Chargez IMOLE_API_KEY depuis une variable d’environnement côté serveur. N’insérez jamais la clé dans le code envoyé au navigateur, une application mobile, un dépôt Git ou un fichier partagé.

Corps de requête

Paramètres acceptés

ParamètreDescriptionValeurs
modelRequis

Utilisez mai-voice-2.

inputRequis

Texte à synthétiser.

voice

Nom explicite de la voix MAI.

language_code

Langue souhaitée, par exemple fr-FR ou en-US.

style

Style d’interprétation.

happy, excited, sad, shouting, softvoice, whispering, angry, hopeful, joyful
style_degree

Intensité du style d’interprétation.

output_format

Format de sortie audio.

audio-24khz-160kbitrate-mono-mp3, riff-24khz-16bit-mono-pcm
Code

Exemples d’intégration

Testez d’abord la requête cURL, puis reprenez le même identifiant de modèle dans votre application JavaScript ou Python.

Voix adaptée à la langue

curl -X POST "https://api.imole.app/v1/audio/speech" \
  -H "Authorization: Bearer $IMOLE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "mai-voice-2",
  "input": "Bonjour. Bienvenue sur Imole.",
  "language_code": "fr-FR",
  "output_format": "audio-24khz-160kbitrate-mono-mp3"
}' \
  --output mai-voice-2.mp3

Voix avec style

curl -X POST "https://api.imole.app/v1/audio/speech" \
  -H "Authorization: Bearer $IMOLE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "mai-voice-2",
  "input": "Imole est pret pour votre prochain projet.",
  "language_code": "fr-FR",
  "style": "happy",
  "style_degree": "1.2",
  "output_format": "audio-24khz-160kbitrate-mono-mp3"
}' \
  --output mai-voice-2-happy.mp3

Identifiant de voix explicite

curl -X POST "https://api.imole.app/v1/audio/speech" \
  -H "Authorization: Bearer $IMOLE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "mai-voice-2",
  "input": "Ceci utilise une voix MAI explicite.",
  "voice": "fr-FR-Soleil:MAI-Voice-2",
  "language_code": "fr-FR",
  "output_format": "audio-24khz-160kbitrate-mono-mp3"
}' \
  --output mai-voice-2-explicit.mp3
Production

Réponse, suivi et erreurs

La route renvoie un fichier ou un objet JSON selon l’opération. Contrôlez le statut HTTP et le type de contenu avant de stocker la réponse.

400

Requête incorrecte : corrigez le champ indiqué avant de réessayer.

401

Clé absente, incorrecte ou révoquée.

402

Solde de cauris insuffisant.

429

Capacité temporairement indisponible : respectez `Retry-After` et utilisez un délai progressif.

5xx

Erreur temporaire : conservez l’identifiant de requête et évitez de relancer deux fois une opération facturable.

Cauris

Tarification et sources

Coût affiché5 cauris

Le coût exact dépend du modèle et, pour certains médias, de la durée, de la résolution ou de la qualité.

Documentation de référenceDocumentation MAI-Voice de Microsoft