voice.send()
send() 方法會將音訊資料實時串流至語音 Provider,以供持續處理。此方法對實時語音對語音對話至關重要,讓你可將咪高峰輸入直接傳送至 AI 服務。
使用範例使用範例 的直接連結
import { OpenAIRealtimeVoice } from '@mastra/voice-openai-realtime'
import Speaker from '@mastra/node-speaker'
import { getMicrophoneStream } from '@mastra/node-audio'
const speaker = new Speaker({
sampleRate: 24100, // Audio sample rate in Hz - standard for high-quality audio on MacBook Pro
channels: 1, // Mono audio output (as opposed to stereo which would be 2)
bitDepth: 16, // Bit depth for audio quality - CD quality standard (16-bit resolution)
})
// Initialize a real-time voice provider
const voice = new OpenAIRealtimeVoice({
realtimeConfig: {
model: 'gpt-5.1-realtime',
apiKey: process.env.OPENAI_API_KEY,
},
})
// Connect to the real-time service
await voice.connect()
// Set up event listeners for responses
voice.on('writing', ({ text, role }) => {
console.log(`${role}: ${text}`)
})
voice.on('speaker', stream => {
stream.pipe(speaker)
})
// Get microphone stream (implementation depends on your environment)
const microphoneStream = getMicrophoneStream()
// Send audio data to the voice provider
await voice.send(microphoneStream)
// You can also send audio data as Int16Array
const audioBuffer = getAudioBuffer() // Assume this returns Int16Array
await voice.send(audioBuffer)
參數參數 的直接連結
audioData:
NodeJS.ReadableStream | Int16Array
要傳送至語音 Provider 的音訊資料。可以是可讀串流(例如咪高峰串流),亦可以是包含音訊樣本的 Int16Array。
傳回值傳回值 的直接連結
傳回 Promise<void>,並在語音 Provider 接受音訊資料後 resolve。
注意事項注意事項 的直接連結
- 此方法只由支援語音對語音功能的實時語音 Provider 實作
- 如在不支援此功能的語音 Provider 上呼叫,系統會記錄警告並立即 resolve
- 使用
send()前必須先呼叫connect(),以建立 WebSocket 連線 - 音訊格式要求視乎個別語音 Provider
- 進行持續對話時,通常會呼叫
send()傳送使用者音訊,然後呼叫answer()觸發 AI 回應 - Provider 處理音訊時,通常會發出包含轉錄文字的 'writing' 事件
- AI 回應時,Provider 會發出包含音訊回應的 'speaking' 事件