Guides Imọlẹ Parcours77 / 88
Modèle · Audio

Scribe v2

Parole vers texte pour transcriptions, sous-titres, diarisation et analyse audio.

Identifiant du modèlescribe_v2
Route API POST /audio/transcriptions
Tester dans le Laboratoire
Présentation du modèle

Ce que fait ce modèle

Scribe v2 transforme la parole enregistrée en texte modifiable. La qualité de l’enregistrement et la langue comptent davantage qu’un long prompt.

Cette page rassemble la description du modèle, les réglages exposés par Imọlẹ et les informations nécessaires pour l’appeler avec l’API.

Capacités

Résultats et opérations pris en charge

  • Entretiens, réunions, sous-titres, enregistrements de recherche et archives consultables.
  • Transformation de la parole audio ou vidéo en texte pour montage ou analyse.
Demande

Décrire clairement le résultat attendu

Construisez la demande dans cet ordre. Chaque étape précise une information que le modèle peut utiliser directement.

  1. 01

    Source propre

    Utilisez l’enregistrement de meilleure qualité disponible et évitez les recompressions inutiles.

  2. 02

    Langue

    Sélectionnez ou confirmez la langue parlée lorsque le modèle propose ce réglage.

  3. 03

    Intervenants

    Activez la séparation des intervenants lorsqu’une conversation contient plusieurs voix.

  4. 04

    Vocabulaire

    Ajoutez noms, marques, acronymes et termes métier lorsque le guidage de vocabulaire est disponible.

Exemple 1

Préparer un entretien

Importez le WAV original ou la vidéo de meilleure qualité. Sélectionnez le français. Activez la séparation de deux intervenants, demandez les horodatages par mot pour le sous-titrage et ajoutez « Imole », « Cauris » et « Cotonou » au vocabulaire lorsque disponible.

La préparation améliore le signal, la structure des intervenants, les horodatages et l’orthographe des termes rares.

Réglages

Contrôles disponibles dans Imọlẹ

Langue

Sélectionnez la langue parlée lorsqu’elle est connue. La détection automatique est pratique mais une langue explicite aide les enregistrements difficiles.

Séparation des intervenants

Utilisez-la pour les entretiens et réunions ; désactivez-la pour un narrateur unique.

Horodatages

Utilisez les horodatages par mot pour les sous-titres et plus larges pour des notes lisibles.

API

Intégrer le modèle dans un projet

MéthodePOST
Chemin/audio/transcriptions
URL de basehttps://api.imole.app/v1
Coût API1 cauris
AuthorizationBearer $IMOLE_API_KEY
Content-TypeUtilisez application/json pour URL/Base64 ou multipart/form-data pour importer un fichier.

Chargez IMOLE_API_KEY depuis une variable d’environnement côté serveur. N’insérez jamais la clé dans le code envoyé au navigateur, une application mobile, un dépôt Git ou un fichier partagé.

Corps de requête

Paramètres acceptés

ParamètreDescriptionValeurs
modelRequis

Utilisez scribe_v2.

fileRequis

Fichier audio ou vidéo à transcrire.

audio_url

URL distante du fichier audio.

audio_base64

Audio en Base64.

language_code

Indication de langue facultative.

diarize

Séparation des intervenants.

true, false
tag_audio_events

Identification des événements non parlés.

true, false
timestamps_granularity

Niveau de détail des horodatages.

none, word, character
keyterms

Termes de vocabulaire à favoriser.

Code

Exemples d’intégration

Testez d’abord la requête cURL, puis reprenez le même identifiant de modèle dans votre application JavaScript ou Python.

Importer un fichier

curl -X POST "https://api.imole.app/v1/audio/transcriptions" \
  -H "Authorization: Bearer $IMOLE_API_KEY" \
  -F "model=scribe_v2" \
  -F "file=@reference.mp3" \
  -F "language_code=fr" \

URL audio distante

curl -X POST "https://api.imole.app/v1/audio/transcriptions" \
  -H "Authorization: Bearer $IMOLE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "scribe_v2",
  "audio_url": "https://imole.app/docs-samples/reference.mp3",
  "language_code": "fr",
  "diarize": false,
  "keyterms": [
    "Imole",
    "API"
  ]
}'

Audio distant avec horodatage des mots

curl -X POST "https://api.imole.app/v1/audio/transcriptions" \
  -H "Authorization: Bearer $IMOLE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "scribe_v2",
  "audio_url": "https://imole.app/docs-samples/reference.mp3",
  "language_code": "fr",
  "timestamps_granularity": "word",
  "tag_audio_events": true
}'
Production

Réponse, suivi et erreurs

La route renvoie un fichier ou un objet JSON selon l’opération. Contrôlez le statut HTTP et le type de contenu avant de stocker la réponse.

400

Requête incorrecte : corrigez le champ indiqué avant de réessayer.

401

Clé absente, incorrecte ou révoquée.

402

Solde de cauris insuffisant.

429

Capacité temporairement indisponible : respectez `Retry-After` et utilisez un délai progressif.

5xx

Erreur temporaire : conservez l’identifiant de requête et évitez de relancer deux fois une opération facturable.

Cauris

Tarification et sources

Coût affiché1 cauris

Le coût exact dépend du modèle et, pour certains médias, de la durée, de la résolution ou de la qualité.

Documentation de référenceDocumentation parole vers texte Scribe v2 d’ElevenLabs