Guides Imọlẹ Parcours74 / 88
Modèle · Audio

GPT Transcribe

Le défaut de la parole vers texte, toutes langues : transcription rapide et fidèle des vocaux, réunions et enregistrements, avec détection automatique de la langue.

Identifiant du modèlegpt-transcribe
Route API POST /audio/transcriptions
Tester dans le Laboratoire
Présentation du modèle

Ce que fait ce modèle

GPT Transcribe transforme la parole enregistrée en texte modifiable. La qualité de l’enregistrement et la langue comptent davantage qu’un long prompt.

Cette page rassemble la description du modèle, les réglages exposés par Imọlẹ et les informations nécessaires pour l’appeler avec l’API.

Capacités

Résultats et opérations pris en charge

  • Entretiens, réunions, sous-titres, enregistrements de recherche et archives consultables.
  • Transformation de la parole audio ou vidéo en texte pour montage ou analyse.
Demande

Décrire clairement le résultat attendu

Construisez la demande dans cet ordre. Chaque étape précise une information que le modèle peut utiliser directement.

  1. 01

    Source propre

    Utilisez l’enregistrement de meilleure qualité disponible et évitez les recompressions inutiles.

  2. 02

    Langue

    Sélectionnez ou confirmez la langue parlée lorsque le modèle propose ce réglage.

  3. 03

    Intervenants

    Activez la séparation des intervenants lorsqu’une conversation contient plusieurs voix.

  4. 04

    Vocabulaire

    Ajoutez noms, marques, acronymes et termes métier lorsque le guidage de vocabulaire est disponible.

Exemple 1

Préparer un entretien

Importez le WAV original ou la vidéo de meilleure qualité. Sélectionnez le français. Activez la séparation de deux intervenants, demandez les horodatages par mot pour le sous-titrage et ajoutez « Imole », « Cauris » et « Cotonou » au vocabulaire lorsque disponible.

La préparation améliore le signal, la structure des intervenants, les horodatages et l’orthographe des termes rares.

Réglages

Contrôles disponibles dans Imọlẹ

Langue

Sélectionnez la langue parlée lorsqu’elle est connue. La détection automatique est pratique mais une langue explicite aide les enregistrements difficiles.

Séparation des intervenants

Utilisez-la pour les entretiens et réunions ; désactivez-la pour un narrateur unique.

Horodatages

Utilisez les horodatages par mot pour les sous-titres et plus larges pour des notes lisibles.

API

Intégrer le modèle dans un projet

MéthodePOST
Chemin/audio/transcriptions
URL de basehttps://api.imole.app/v1
Coût API1 cauris
AuthorizationBearer $IMOLE_API_KEY
Content-TypeUtilisez application/json pour les requêtes JSON.

Chargez IMOLE_API_KEY depuis une variable d’environnement côté serveur. N’insérez jamais la clé dans le code envoyé au navigateur, une application mobile, un dépôt Git ou un fichier partagé.

Corps de requête

Paramètres acceptés

ParamètreDescriptionValeurs
modelRequis

Identifiant du modèle texte.

inputRequis

Texte simple ou tableau d’entrées au format Responses.

messages

Tableau de messages de conversation. Utilisez-le avec Chat Completions ou pour une compatibilité existante.

instructions

Instruction système ou développeur placée avant la demande utilisateur.

max_output_tokens

Contrôle de sortie fournisseur optionnel. Imọlẹ ne l’exige pas et n’impose pas son propre plafond de tokens.

reasoning

Contrôles de raisonnement optionnels quand ils sont pris en charge, notamment effort et le mode Pro.

temperature

Variation de l’échantillonnage lorsque le modèle la prend en charge.

top_p

Contrôle de l’échantillonnage par noyau.

stream

Renvoie des événements serveur au fil de la génération lorsque pris en charge.

true, false
tools

Définitions des outils disponibles pour les requêtes Responses avec outils.

tool_choice

Règle de sélection des outils.

auto, none, required
parallel_tool_calls

Autorise plusieurs appels d’outils dans un même tour.

true, false
text.format

Réglages du format de texte structuré pour Responses.

response_format

Champ de compatibilité pour demander une sortie de type JSON.

metadata

Métadonnées facultatives associées à la requête.

Code

Exemples d’intégration

Testez d’abord la requête cURL, puis reprenez le même identifiant de modèle dans votre application JavaScript ou Python.

Production

Réponse, suivi et erreurs

La route renvoie un fichier ou un objet JSON selon l’opération. Contrôlez le statut HTTP et le type de contenu avant de stocker la réponse.

400

Requête incorrecte : corrigez le champ indiqué avant de réessayer.

401

Clé absente, incorrecte ou révoquée.

402

Solde de cauris insuffisant.

429

Capacité temporairement indisponible : respectez `Retry-After` et utilisez un délai progressif.

5xx

Erreur temporaire : conservez l’identifiant de requête et évitez de relancer deux fois une opération facturable.

Cauris

Tarification et sources

Coût affiché1 cauris

Le coût exact dépend du modèle et, pour certains médias, de la durée, de la résolution ou de la qualité.

Documentation de référenceDocumentation Azure OpenAI des modèles de transcription GPT