AIによる電話の待ち時間は、どこから来るのでしょうか?
通話の開始にあたり、最初に電信やSIP/PBXを経由し、音声が処理された後、システムは通話者が話が終わったかどうかを判断します。その後、モデルが企業ツールを認識し、最後に返信を音声として電話に転送します。CRMの照会や工藤の作成など、ツールを使用する際には、遅延が発生する可能性があります。モデルが認識する最初のトークンのみを考慮するため、通話者が実際に体験する全体の経路は無視されます。
| 階段 | 測定開始と終了 | 一般的なリスク |
|---|---|---|
| 電話回線によるデータ伝送 | 通話の音声が、入室・退室の音声プラットフォームと連携する。 | 電信回線、符号化・復号、ネットワークの不安定性、およびパケットの喪失 |
| ステップごとの判断 | ユーザーは発話を停止し、システムが終了を確認するまで待機します。 | あまり長く待ったり、または時期を早くすぎに終了させたりした場合 |
| モデル回答 | 有効な入力が提供され、再生可能なコンテンツが生成される。 | 文脈が長すぎる、モデルの選択、複雑な推論 |
| ツール呼び出し | API を呼び出して、利用可能な結果を取得する | 企業システムがタイムアウトした場合、再試行とキューへの格納 |
| 音声再生 | テキストや音声が、電話を通じて再生されるように設定する。 | 合成的なバッファ、ヘッドホンでの待機と再生の停止 |