RealtimeClientEventInputAudioBufferAppend interface
傳送此事件,將音訊位元組附加到輸入音訊緩衝區。 音訊緩衝區是一個暫時的儲存空間,可供寫入並在之後提交。 「commit」會從緩衝區內容在對話歷史中建立新的使用者訊息項目,並清除緩衝區。 當緩衝區被提交時,會產生輸入音訊轉錄(若啟用)。 若啟用 VAD,音訊緩衝區會用於偵測語音,伺服器將決定何時提交。 當伺服器 VAD 停用時,你必須手動提交音訊緩衝。 音訊輸入降噪功能是在將數據寫入音訊緩衝區時運作。 用戶端可選擇每個事件中放入多少音訊,最多可達 15 MiB,例如從用戶端串流較小的音訊區塊,可能讓 VAD 反應更快。 與大多數其他客戶端事件不同,伺服器不會對此事件發送確認回應。
- Extends
屬性
| audio | Base64編碼的音訊位元組。 這必須依照會話設定欄位指定的 |
| event_id | 可選擇的客戶端生成的 ID 用來識別此事件。 |
| type | 事件類型 必須是 |
屬性詳細資料
audio
Base64編碼的音訊位元組。 這必須依照會話設定欄位指定的 input_audio_format 格式進行。
audio: string
屬性值
string
event_id
可選擇的客戶端生成的 ID 用來識別此事件。
event_id?: string
屬性值
string
type
事件類型 必須是 input_audio_buffer.append。
type: "input_audio_buffer.append"
屬性值
"input_audio_buffer.append"