OpenAIがGPT-6.1 SolにUltrafastモードを追加しました。中身はわかりやすく、出力が大幅に速くなる代わりに料金も大きく上がります。OpenAIによると、標準モードのSolより最大8倍速く、知能はGPT-6 Astraに近い水準です。一方でAPIの料金は標準の6倍です。CodexとChatGPT Workでは、今のところPro $500と対象のEnterprise、Eduプランでしか使えません。
OpenAI Developersのアカウントは北京時間10月9日2時26分にXで発表し、GPT-6.1 SolのUltrafastをAPI、Codex、ChatGPT Workで本日から順次展開するとしました。「8倍」はOpenAI自身の数字で、第三者による計測はまだありません。Tibo(@thsottiaux)は北京時間3時15分に投稿し、これを28日間のCodex改善計画の4日目としました。ステアリングが即座になり、指示を変えるとモデルの反応がかなり速くなったので、その場で方向を修正でき、モデルが無駄な作業をしなくなったと書いています。この二つはとても相性がよいとも述べています。
APIの料金
OpenAIのドキュメントによると、UltrafastはGPT-6.1 SolとGPT-6 Astraの両方で、すべてのAPIユーザーが使えるようになりました。gpt-6.1-solでサービスティアをultrafastに設定すれば有効になります。OpenAIの料金ページでは、GPT-6.1 Sol Ultrafastは短いコンテキストで100万トークンあたり入力12ドル、キャッシュ入力0.60ドル、キャッシュ書き込み15ドル、出力60ドルです。標準の2ドル、0.10ドル、2.50ドル、10ドルのちょうど6倍にあたります。長いコンテキストでは入力24ドル、出力90ドルです。既存の中間オプションであるFastモードは標準の2倍です。
数字を並べると、Sol Ultrafastの入力と出力は、標準モードのGPT-6 Astra(入力10ドル、出力50ドル)を少し上回ります。例外はキャッシュ入力で、0.60ドルとAstraの1ドルです。Ultrafastに払うお金は節約ではなく、待ち時間を短くするためのものです。
Ultrafastには標準やFastとは別の利用上限があります。GPT-6.1 Solの初期設定は、Buildティアで毎分100万トークン、Launchで400万、Growで4000万で、Astra Ultrafastの50万、100万、500万を大きく上回ります。Sol Ultrafastは米国とEUのデータレジデンシーに対応していますが、Astra Ultrafastは米国のみです。ツール呼び出しを短い間隔で何度も行うエージェント型アプリでは、接続のオーバーヘッドで速度の利点が目減りするため、OpenAIはWebSocketの利用を勧めています。
CodexとChatGPT Workで使える人
CodexとChatGPT Workでは、UltrafastはPro $500と対象のEnterprise、Eduプランに限られます。OpenAIによると、そのほかのセルフサービスのプランでは、クレジットを購入していても提供開始時点では使えません。Pro $500では、まずプランに含まれる利用枠を使い、それを使い切るとクレジットに切り替わります。
利用枠の減りも速くなります。Ultrafastはプランに含まれる利用枠を標準の8倍のペースで消費し、購入したクレジットとEnterpriseの従量課金には標準の6倍の料金がかかります。Enterpriseでは初期状態でオフになっており、ワークスペースのオーナーが特定のユーザーかワークスペース全体に対して有効にする必要があります。従量課金ではなく利用上限で運用している旧来のEnterpriseプランは対象外です。APIキーでCodexを使う場合は、上記のAPIのトークン料金が適用されます。
28日間の計画の動きは引き続き追っていきます。チームが何を約束したかは、以前の記事「Tiboが28日間計画を発表:毎日Codexの実用的改善か完全リセットを実施」でまとめています。
