跳至主要內容

voice.send()

send() 方法會將音訊資料實時串流至語音 Provider,以供持續處理。此方法對實時語音對語音對話至關重要,讓你可將咪高峰輸入直接傳送至 AI 服務。

使用範例
使用範例 的直接連結

import { OpenAIRealtimeVoice } from '@mastra/voice-openai-realtime'
import Speaker from '@mastra/node-speaker'
import { getMicrophoneStream } from '@mastra/node-audio'

const speaker = new Speaker({
sampleRate: 24100, // Audio sample rate in Hz - standard for high-quality audio on MacBook Pro
channels: 1, // Mono audio output (as opposed to stereo which would be 2)
bitDepth: 16, // Bit depth for audio quality - CD quality standard (16-bit resolution)
})

// Initialize a real-time voice provider
const voice = new OpenAIRealtimeVoice({
realtimeConfig: {
model: 'gpt-5.1-realtime',
apiKey: process.env.OPENAI_API_KEY,
},
})

// Connect to the real-time service
await voice.connect()

// Set up event listeners for responses
voice.on('writing', ({ text, role }) => {
console.log(`${role}: ${text}`)
})

voice.on('speaker', stream => {
stream.pipe(speaker)
})

// Get microphone stream (implementation depends on your environment)
const microphoneStream = getMicrophoneStream()

// Send audio data to the voice provider
await voice.send(microphoneStream)

// You can also send audio data as Int16Array
const audioBuffer = getAudioBuffer() // Assume this returns Int16Array
await voice.send(audioBuffer)

參數
參數 的直接連結


audioData:

NodeJS.ReadableStream | Int16Array
要傳送至語音 Provider 的音訊資料。可以是可讀串流(例如咪高峰串流),亦可以是包含音訊樣本的 Int16Array。

傳回值
傳回值 的直接連結

傳回 Promise<void>,並在語音 Provider 接受音訊資料後 resolve。

注意事項
注意事項 的直接連結

  • 此方法只由支援語音對語音功能的實時語音 Provider 實作
  • 如在不支援此功能的語音 Provider 上呼叫,系統會記錄警告並立即 resolve
  • 使用 send() 前必須先呼叫 connect(),以建立 WebSocket 連線
  • 音訊格式要求視乎個別語音 Provider
  • 進行持續對話時,通常會呼叫 send() 傳送使用者音訊,然後呼叫 answer() 觸發 AI 回應
  • Provider 處理音訊時,通常會發出包含轉錄文字的 'writing' 事件
  • AI 回應時,Provider 會發出包含音訊回應的 'speaking' 事件