OpenAIは10月8日、開発者コミュニティでGPT-6.1 SolのUltrafastモードを、API、Codex、ChatGPT Workへ展開すると告知した。位置づけは、標準のSolより最大8倍速く、知能はAstraに近い、というものだ。API料金は入力100万トークンあたり12ドル、出力100万トークンあたり60ドルで、Astraの1.2倍としている。想定する用途は、障害対応のデバッグ、アプリを操作するエージェント、秒単位が効くライブ体験である。
CodexとChatGPT Workで使えるのは、Pro 500、対象となる従量課金のEnterprise、クレジット制のEduだ。Enterpriseは管理者がアクセスを有効化する必要がある。UltrafastのGPT-6.1 Solは対応リージョン全体で提供し、米国とEUのデータ居住地にも対応する。あわせて、GPT-6.1 SolのFastとGPT-6 LunaのFastにも、EUのデータ居住地を追加した。
告知が参照するAPIドキュメントは、GPT-6 AstraとGPT-6.1 SolのUltrafastをWebSocketで使う手順と、HTTPの代替を案内している。ツール呼び出しが連続するエージェントでは、リクエストのたびに接続を張り直すと、速度の利得が通信のオーバーヘッドで削られる。
これは、サブスクリプション経由で既存モデルを速くする更新とは別の、割増の処理階層である。速度が待ち時間の短縮としてそのまま効く作業に限定し、入出力の単価が標準より高い前提で予算を切る。リージョンとデータ居住地の組み合わせは、使うモデルとモードごとに告知の条件を確認したい。