本文へスキップ
MameTechNews
AI

OpenAIがGPT-Live-1をAPI提供、自然なフルデュプレックス音声会話をアプリへ

## POINTS

  • GPT-Live-1がAPI提供され、自然な双方向音声会話を単一モデルで扱える
  • 割り込み・相づち・トーン制御に対応し低遅延が訴求点
  • アプリ組み込み時は分課金とセッション設計の最適化が鍵

OpenAIはフルデュプレックス会話向けモデルGPT-Live-1をAPIで提供開始したとされる。割り込みや相づちを自然に処理し、従来の連鎖処理より低遅延で、トーンやペースをプロンプトから制御できる。バックエンド処理の委任も可能で、料金は約1分0.05ドルと手頃な水準が語られている。日本の実装者からもレスポンスの速さへの反応があり、ロボット・カスタマーサポート・語学学習などへの適用が期待されている。

エンジニア視点:

  • 音声UXを自前でステートマシン管理する負荷を下げられる
  • 料金は分単位課金なのでセッション設計と無音切断が重要
  • 既存Realtime/音声スタックとの比較検証が導入判断の中心