Routez vos meetings Zoom, Google Meet et Microsoft Teams via Speechmatics : un bot enregistre l'appel, le modèle avancé de Speechmatics le transcrit avec séparation des interlocuteurs, livré par webhook.

LLazare Rossillon
··2 min read
Comment enregistrer et transcrire des meetings avec Speechmatics

Speechmatics s'est forgé une réputation de précision face aux accents et aux dialectes — ces meetings où une seule étiquette linguistique ne résiste pas au premier contact avec une équipe internationale. Comme toute API de reconnaissance vocale, cependant, elle part d'un fichier audio. Obtenir le meeting dans un fichier, c'est votre problème.

Un bot de meeting fait de ce problème une seule requête POST. Ce guide route les appels Zoom, Google Meet et Microsoft Teams via votre compte Speechmatics.

Les équipes entreprise standardisent souvent sur Speechmatics pour sa robustesse face aux accents et ses options on-premise — associer un bot de meeting compatible on-premise garde toute la chaîne sous votre contrôle.

Étape 1 : Obtenez vos clés

Étape 2 : Envoyez un bot configuré avec Speechmatics

curl -X POST "https://api.meetingbaas.com/v2/bots" \
     -H "Content-Type: application/json" \
     -H "x-meeting-baas-api-key: $API_KEY" \
     -d '{
           "meeting_url": "https://teams.microsoft.com/l/meetup-join/...",
           "bot_name": "Speechmatics Bot",
           "transcription_config": {
             "provider": "speechmatics",
             "api_key": "'"$SPEECHMATICS_API_KEY"'",
             "custom_params": {
               "language": "en",
               "model": "enhanced",
               "diarization": "speaker"
             }
           }
         }'

custom_params correspond à la configuration native de Speechmatics : language, le modèle enhanced pour une précision maximale, et diarization: "speaker" pour identifier qui a dit quoi. Les déploiements spécifiques à une région sont couverts par le champ region sur transcription_config.

Le bot pod capture l'audio du meeting, Speechmatics le transcrit sous votre clé API avec le modèle amélioré et la séparation des interlocuteurs, et le JSON natif est renvoyé par webhook

Étape 3 : Recevoir la sortie native Speechmatics

Votre webhook reçoit l'artefact de transcription dans la structure de réponse native de Speechmatics, ainsi que l'enregistrement, les événements d'entrée/sortie des participants et la timeline du bot dans le format standard de Meeting BaaS. Si vous migrez depuis l'envoi de fichiers vers l'API batch Speechmatics, le code d'analyse de sortie que vous avez déjà reste utilisable.

Pourquoi cette combinaison

  • Robustesse aux accents et aux dialectes : les meetings sont exactement le type d'audio sur lequel Speechmatics est le plus performant — des appels transfrontaliers avec des accents mixtes.
  • Chaînes de conformité : Meeting BaaS prend en charge le déploiement on-premise ; combiné avec les options de déploiement de Speechmatics, les équipes soumises à des réglementations peuvent garder l'audio dans leur périmètre.
  • Votre facturation : l'utilisation de Speechmatics s'effectue sur votre compte ; Meeting BaaS ajoute 0,05 tokens par heure enregistrée pour la transcription avec votre propre clé (plans Pro et supérieurs), en plus du tarif d'enregistrement de 1 token par heure.

Prochaines étapes

Articles similairestutorial