Deepgram
L'implémentation vocale Deepgram de Mastra fournit des fonctionnalités de synthèse vocale (TTS) et de reconnaissance vocale (STT) au moyen de l'API Deepgram. Elle prend en charge plusieurs modèles vocaux et plusieurs langues, avec des options configurables pour la synthèse vocale et la transcription.
Exemple d'utilisationLien direct vers Exemple d'utilisation
import { DeepgramVoice } from '@mastra/voice-deepgram'
// Initialize with default configuration (uses DEEPGRAM_API_KEY environment variable)
const voice = new DeepgramVoice()
// Initialize with custom configuration
const voice = new DeepgramVoice({
speechModel: {
name: 'aura',
apiKey: 'your-api-key',
},
listeningModel: {
name: 'nova-2',
apiKey: 'your-api-key',
},
speaker: 'asteria-en',
})
// Text-to-Speech
const audioStream = await voice.speak('Hello, world!')
// Speech-to-Text
const transcript = await voice.listen(audioStream)
Paramètres du constructeurLien direct vers Paramètres du constructeur
speechModel?:
DeepgramVoiceConfig
= { name: 'aura' }
Configuration de la fonctionnalité de synthèse vocale.
DeepgramVoiceConfig
name?:
DeepgramModel
Modèle Deepgram à utiliser
apiKey?:
string
Clé d'API Deepgram. Utilise par défaut la variable d'environnement DEEPGRAM_API_KEY
properties?:
Record<string, any>
Propriétés supplémentaires à transmettre à l'API Deepgram
language?:
string
Code de langue du modèle
listeningModel?:
DeepgramVoiceConfig
= { name: 'nova' }
Configuration de la fonctionnalité de reconnaissance vocale.
DeepgramVoiceConfig
name?:
DeepgramModel
Modèle Deepgram à utiliser
apiKey?:
string
Clé d'API Deepgram. Utilise par défaut la variable d'environnement DEEPGRAM_API_KEY
properties?:
Record<string, any>
Propriétés supplémentaires à transmettre à l'API Deepgram
language?:
string
Code de langue du modèle
speaker?:
DeepgramVoiceId
= 'asteria-en'
Voix à utiliser par défaut pour la synthèse vocale
MéthodesLien direct vers Méthodes
speak()Lien direct vers speak
Convertit du texte en parole au moyen du modèle vocal et de la voix configurés.
input:
string | NodeJS.ReadableStream
Texte à convertir en parole. Si un flux est fourni, il est d'abord converti en texte.
options?:
object
Options supplémentaires pour la synthèse vocale
object
speaker?:
string
Remplace la voix par défaut pour cette requête
Renvoie : Promise<NodeJS.ReadableStream>
listen()Lien direct vers listen
Convertit la parole en texte au moyen du modèle de reconnaissance configuré.
audioStream:
NodeJS.ReadableStream
Flux audio à transcrire
options?:
object
Options supplémentaires à transmettre à l'API Deepgram
Renvoie : Promise<string>
getSpeakers()Lien direct vers getspeakers
Renvoie la liste des options vocales disponibles.
voiceId:
string
Identifiant unique de la voix