跳至主要內容

voice.send()

send() 方法會將音訊資料即時串流至語音 Provider,以進行連續處理。此方法是即時語音對語音對話不可或缺的一環,讓你可以直接將麥克風輸入傳送至 AI 服務。

使用範例
「使用範例」的直接連結

import { OpenAIRealtimeVoice } from '@mastra/voice-openai-realtime'
import Speaker from '@mastra/node-speaker'
import { getMicrophoneStream } from '@mastra/node-audio'

const speaker = new Speaker({
sampleRate: 24100, // Audio sample rate in Hz - standard for high-quality audio on MacBook Pro
channels: 1, // Mono audio output (as opposed to stereo which would be 2)
bitDepth: 16, // Bit depth for audio quality - CD quality standard (16-bit resolution)
})

// Initialize a real-time voice provider
const voice = new OpenAIRealtimeVoice({
realtimeConfig: {
model: 'gpt-5.1-realtime',
apiKey: process.env.OPENAI_API_KEY,
},
})

// Connect to the real-time service
await voice.connect()

// Set up event listeners for responses
voice.on('writing', ({ text, role }) => {
console.log(`${role}: ${text}`)
})

voice.on('speaker', stream => {
stream.pipe(speaker)
})

// Get microphone stream (implementation depends on your environment)
const microphoneStream = getMicrophoneStream()

// Send audio data to the voice provider
await voice.send(microphoneStream)

// You can also send audio data as Int16Array
const audioBuffer = getAudioBuffer() // Assume this returns Int16Array
await voice.send(audioBuffer)

參數
「參數」的直接連結


audioData:

NodeJS.ReadableStream | Int16Array
要傳送至語音 Provider 的音訊資料。可以是可讀取串流(例如麥克風串流),也可以是由音訊樣本組成的 Int16Array。

傳回值
「傳回值」的直接連結

傳回 Promise<void>;語音 Provider 接受音訊資料後便會 resolve。

注意事項
「注意事項」的直接連結

  • 只有支援語音對語音功能的即時語音 Provider 才會實作此方法
  • 若對不支援此功能的語音 Provider 呼叫此方法,系統會記錄警告並立即 resolve
  • 必須先呼叫 connect() 建立 WebSocket 連線,才能使用 send()
  • 音訊格式需求取決於特定語音 Provider
  • 如需進行連續對話,通常會呼叫 send() 傳送使用者音訊,再呼叫 answer() 觸發 AI 回應
  • Provider 通常會在處理音訊時發出含有轉錄文字的 'writing' 事件
  • AI 回應時,Provider 會發出含有音訊回應的 'speaking' 事件