본문으로 건너뛰기

말하기

Mastra의 Speechify 음성 구현은 Speechify의 API를 사용하여 텍스트 음성 변환 기능을 제공합니다.

사용예
사용예에 대한 직접 링크

import { SpeechifyVoice } from '@mastra/voice-speechify'

// Initialize with default configuration (uses SPEECHIFY_API_KEY environment variable)
const voice = new SpeechifyVoice()

// Initialize with custom configuration
const voice = new SpeechifyVoice({
speechModel: {
name: 'simba-3.2',
apiKey: 'your-api-key',
},
speaker: 'harper_32', // Default voice (simba-3.2 serves the curated Simba 3 voices only)
})

// Convert text to speech
const audioStream = await voice.speak('Hello, world!', {
speaker: 'imogen_32', // Override default voice
})

생성자 매개변수
생성자 매개변수에 대한 직접 링크

speechModel?:

SpeechifyConfig
= { name: 'simba-english' }
텍스트-음성 기능의 구성
SpeechifyConfig

name?:

SpeechifyModel
사용할 Speechify Model('simba-3.2', 'simba-3.0', 'simba-english' 또는 'simba-multilingual')

apiKey?:

string
Speechify API 키입니다. 지정하지 않으면 SPEECHIFY_API_KEY 환경 변수를 사용합니다

speaker?:

SpeechifyVoiceId
= Simba 3 Model에서는 'harper_32', 그 외에는 'george'
음성 합성에 사용할 기본 음성 ID입니다. Simba 3 Model은 선별된 음성 세트(harper_32, imogen_32, ...)만 제공하며, 기존 카탈로그 음성(george, henry, ...)은 simba-english 및 simba-multilingual에서 작동합니다

행동 양식
행동 양식에 대한 직접 링크

speak()
speak에 대한 직접 링크

구성된 음성 Model 및 음성을 사용하여 텍스트를 음성으로 변환합니다.

input:

string | NodeJS.ReadableStream
음성으로 변환할 텍스트입니다. 스트림을 제공하면 먼저 텍스트로 변환됩니다.

options?:

Options
구성 옵션입니다.
Options

speaker?:

string
이 요청의 기본 화자를 재정의합니다

model?:

SpeechifyModel
이 요청의 기본 Model을 재정의합니다

보고:Promise<NodeJS.ReadableStream>

getSpeakers()
getspeakers에 대한 직접 링크

각 노드에 다음이 포함된 사용 가능한 음성 옵션의 배열을 반환합니다.

voiceId:

string
음성의 고유 식별자

name:

string
음성의 표시 이름

language:

string
음성의 언어 코드

gender:

string
음성의 성별

listen()
listen에 대한 직접 링크

이 방법은 Speechify에서 지원되지 않으며 오류가 발생합니다. Speechify는 음성을 텍스트로 변환하는 기능을 제공하지 않습니다.

메모
메모에 대한 직접 링크

  • Speechify에는 인증을 위해 API 키가 필요합니다.
  • 기본 Model은 'simba-english'입니다.
  • 'simba-3.2'는 Speechify의 최신 스트리밍 Model로 가장 낮은 지연 시간과 가장 풍부한 표현력을 갖춘 영어 추천 Model입니다.
  • 'simba-3.2' 및 'simba-3.0'은 현재 영어로만 제공됩니다. 영어가 아닌 언어나 혼합 언어 입력에는 'simba-multilingual'을 사용하세요.
  • 'simba-3.2' 및 'simba-3.0'은 엄선된 음성 세트인 'beatrice_32', 'dominic_32', 'edmund_32', 'geffen_32', 'harper_32', 'hugh_32', 'imogen_32', 'wyatt_32'만 제공합니다. 'george'와 같은 기존 카탈로그 음성은 이러한 Model에서 오류를 반환합니다.
  • 기본 스피커는 구성된 Model을 따릅니다: Simba 3 Model의 경우 'harper_32', 그렇지 않으면 'george'
  • 음성-텍스트 기능은 지원되지 않습니다.
  • 추가 오디오 스트림 옵션은 talk() 메서드의 옵션 매개변수를 통해 전달될 수 있습니다.