Aller au contenu principal

Deepgram

L'implémentation vocale Deepgram de Mastra fournit des fonctionnalités de synthèse vocale (TTS) et de reconnaissance vocale (STT) au moyen de l'API Deepgram. Elle prend en charge plusieurs modèles vocaux et plusieurs langues, avec des options configurables pour la synthèse vocale et la transcription.

Exemple d'utilisation
Lien direct vers Exemple d'utilisation

import { DeepgramVoice } from '@mastra/voice-deepgram'

// Initialize with default configuration (uses DEEPGRAM_API_KEY environment variable)
const voice = new DeepgramVoice()

// Initialize with custom configuration
const voice = new DeepgramVoice({
speechModel: {
name: 'aura',
apiKey: 'your-api-key',
},
listeningModel: {
name: 'nova-2',
apiKey: 'your-api-key',
},
speaker: 'asteria-en',
})

// Text-to-Speech
const audioStream = await voice.speak('Hello, world!')

// Speech-to-Text
const transcript = await voice.listen(audioStream)

Paramètres du constructeur
Lien direct vers Paramètres du constructeur

speechModel?:

DeepgramVoiceConfig
= { name: 'aura' }
Configuration de la fonctionnalité de synthèse vocale.
DeepgramVoiceConfig

name?:

DeepgramModel
Modèle Deepgram à utiliser

apiKey?:

string
Clé d'API Deepgram. Utilise par défaut la variable d'environnement DEEPGRAM_API_KEY

properties?:

Record<string, any>
Propriétés supplémentaires à transmettre à l'API Deepgram

language?:

string
Code de langue du modèle

listeningModel?:

DeepgramVoiceConfig
= { name: 'nova' }
Configuration de la fonctionnalité de reconnaissance vocale.
DeepgramVoiceConfig

name?:

DeepgramModel
Modèle Deepgram à utiliser

apiKey?:

string
Clé d'API Deepgram. Utilise par défaut la variable d'environnement DEEPGRAM_API_KEY

properties?:

Record<string, any>
Propriétés supplémentaires à transmettre à l'API Deepgram

language?:

string
Code de langue du modèle

speaker?:

DeepgramVoiceId
= 'asteria-en'
Voix à utiliser par défaut pour la synthèse vocale

Méthodes
Lien direct vers Méthodes

speak()
Lien direct vers speak

Convertit du texte en parole au moyen du modèle vocal et de la voix configurés.

input:

string | NodeJS.ReadableStream
Texte à convertir en parole. Si un flux est fourni, il est d'abord converti en texte.

options?:

object
Options supplémentaires pour la synthèse vocale
object

speaker?:

string
Remplace la voix par défaut pour cette requête

Renvoie : Promise<NodeJS.ReadableStream>

listen()
Lien direct vers listen

Convertit la parole en texte au moyen du modèle de reconnaissance configuré.

audioStream:

NodeJS.ReadableStream
Flux audio à transcrire

options?:

object
Options supplémentaires à transmettre à l'API Deepgram

Renvoie : Promise<string>

getSpeakers()
Lien direct vers getspeakers

Renvoie la liste des options vocales disponibles.

voiceId:

string
Identifiant unique de la voix