本文へスキップ
MameTechNews
AI

AWS、音声エージェント向けNova 2.5 Sonicを東京を含む4リージョンで提供

## POINTS

  • 東京を含む4リージョンのBedrockで一般提供。料金はNova 2 Sonicと同じで、コンテキストは256K。
  • Strands Bidi Agentsも同時に一般提供され、長い会話と他エージェント接続を少ないコードで組める。
  • 改善幅の数値は告知にない。切り替え前に、自前の対話とツール呼び出しで差分を測る。

AWSは10月5日、リアルタイム音声エージェント向けのspeech-to-speechモデル、Amazon Nova 2.5 Sonicの一般提供を発表した。前世代と比べ、推論、指示への追従、ツール呼び出しの精度を上げ、遅延を下げて会話を自然にしたとする。具体的な改善幅の数値は、この告知には載っていない。

モデルは会話の流れを保ったまま、複数段の指示に従い、接続したツールで作業を完了できる。告知の例では、注文の照会、返品可否の確認、返品手続きを1つの会話で行う。既存機能として、7言語の音声、発話の順番の制御、同一セッションでの音声とテキスト、非同期のツール呼び出し、256Kのコンテキストを引き継ぐ。

開発向けには、Strands Bidi Agentsも同時に一般提供された。少ないコードで本番の音声エージェントを組み、長い会話や他のエージェントとの接続に使う想定だ。利用できるBedrockのリージョンは、米国東部(バージニア北部)、米国西部(オレゴン)、欧州(ストックホルム)、アジアパシフィック(東京)。料金はNova 2 Sonicと同じ。

東京リージョンで音声の顧客対応やアシスタントをBedrock上に置くなら、モデル名の更新だけで試せる可能性がある。ただし告知は品質改善の幅を数値で示していない。既存のNova 2 Sonicとの差分は、自前の対話とツール呼び出しで測ってから切り替えるのがよい。対応言語が7つのままである点も、日本語以外の要件と突き合わせる。