voice.send()
send() 方法會將音訊資料即時串流至語音 Provider,以進行連續處理。此方法是即時語音對語音對話不可或缺的一環,讓你可以直接將麥克風輸入傳送至 AI 服務。
使用範例「使用範例」的直接連結
import { OpenAIRealtimeVoice } from '@mastra/voice-openai-realtime'
import Speaker from '@mastra/node-speaker'
import { getMicrophoneStream } from '@mastra/node-audio'
const speaker = new Speaker({
sampleRate: 24100, // Audio sample rate in Hz - standard for high-quality audio on MacBook Pro
channels: 1, // Mono audio output (as opposed to stereo which would be 2)
bitDepth: 16, // Bit depth for audio quality - CD quality standard (16-bit resolution)
})
// Initialize a real-time voice provider
const voice = new OpenAIRealtimeVoice({
realtimeConfig: {
model: 'gpt-5.1-realtime',
apiKey: process.env.OPENAI_API_KEY,
},
})
// Connect to the real-time service
await voice.connect()
// Set up event listeners for responses
voice.on('writing', ({ text, role }) => {
console.log(`${role}: ${text}`)
})
voice.on('speaker', stream => {
stream.pipe(speaker)
})
// Get microphone stream (implementation depends on your environment)
const microphoneStream = getMicrophoneStream()
// Send audio data to the voice provider
await voice.send(microphoneStream)
// You can also send audio data as Int16Array
const audioBuffer = getAudioBuffer() // Assume this returns Int16Array
await voice.send(audioBuffer)
參數「參數」的直接連結
audioData:
NodeJS.ReadableStream | Int16Array
要傳送至語音 Provider 的音訊資料。可以是可讀取串流(例如麥克風串流),也可以是由音訊樣本組成的 Int16Array。
傳回值「傳回值」的直接連結
傳回 Promise<void>;語音 Provider 接受音訊資料後便會 resolve。
注意事項「注意事項」的直接連結
- 只有支援語音對語音功能的即時語音 Provider 才會實作此方法
- 若對不支援此功能的語音 Provider 呼叫此方法,系統會記錄警告並立即 resolve
- 必須先呼叫
connect()建立 WebSocket 連線,才能使用send() - 音訊格式需求取決於特定語音 Provider
- 如需進行連續對話,通常會呼叫
send()傳送使用者音訊,再呼叫answer()觸發 AI 回應 - Provider 通常會在處理音訊時發出含有轉錄文字的 'writing' 事件
- AI 回應時,Provider 會發出含有音訊回應的 'speaking' 事件