DAILY

ChatGPTの超高速モードで、20分で利用枠の6割が消えた

Podcast ↗

ChatGPTの超高速モードは、同じ量の作業でも利用枠を通常の8倍使う仕組みで、僕はコードの見直しを20分ほど頼んだだけで枠の6割を使ったので、速いモードは減り方を知ってから押してください。

9月29日(米国時間)、OpenAIの発表会があった日の話です。新しいプランが出て、目玉の一つが「Ultrafast」という超高速モードでした。僕はかなり期待していて、その日のうちにプランを上げました。

試しに頼んだのは、手元のパソコンとクラウドと、公開している本番の環境まで、僕のプロジェクトを丸ごとコードレビューして直してもらう仕事です。

終わったのは15分か20分くらい。速いことは速いです。そこで利用量のメーターを見たら、100%あったはずの残りが39%になっていました。

20分で6割。もう1回、同じ大きさの仕事を頼んだら、ほぼ終わりです。

そのとき口から出たのが「作業が速くなったっていうより、使用量が超高速で減ってるだけじゃん」でした。この記事はほぼ、この一言の答え合わせです。


速さの代金は、利用枠で払っている

後から公式の説明を読んで、納得しました。Codexの速さの設定のページには、Ultrafastは対応モデルで、プランに含まれる利用枠を標準の8倍の割合で使う、と書いてあります。もう一段ゆるい「Fast」モードでも2.5倍です。

一方で、発表会のまとめでは、Ultrafastは文字を作る速さが最大8倍(Codexで毎秒300トークン)とされています。速さが最大8倍で、枠の減り方も8倍。速くなったぶん、同じ仕事をこなす量が増えたわけではなく、同じ仕事を速く終わらせる代わりに枠を多く払う、という作りです。

単純に割り算すると、僕が20分で使った61%は、標準の速さなら8%弱で済んだ計算になります。待ち時間は延びても、枠は何倍も長持ちしたはずです。メーターが減るのを見て「まずい」と感じたのは、気のせいではありませんでした。

ちなみにUltrafastが使えるのは、今のところ月500ドルの最上位プランと一部の法人向けプランだけです。値段の話をしたいのではなく、言いたいのはFastのほうです。Fastは、Ultrafastのように最上位プラン限定とは書かれていません。使える環境で2.5倍を選ぶと、同じ枠が4割ほどの仕事量で尽きます。気づかずに押していると、「最近すぐ上限が来る」の原因が自分の設定だった、ということが起きます。


減らなかった夜は、考える設定を上げていた

前から不思議に思っていたことがあります。僕が使っている中で、OpenAIのAIは枠がすぐ減る。AnthropicとGoogleのAIは逆で、ゴリゴリ動かしても使い切るのが大変なくらい残ります。会社ごとの差の理由は、正直まだ分かりません。ただ少なくとも「20分で6割」の件は、モードの倍率で説明がつきました。

面白いのは、Ultrafastを試す数時間前に、真逆のことに気づいていたことです。

僕はAIにほぼ全部を任せるやり方で使っています。方針と方向性だけ伝えて、あとは任せる。研究のような作業もさせているので、途中で小さなミスがあると、変なファイルが残ったり、後始末が増えたりして面倒なんです。

だから、別の会社のAIで、考える深さの設定を「高い」から一段上げていました。上げたら、枠が減らなくなりました。7つの作業を並列で動かしていて、30分で1%くらいしか減らない。

ここからは僕の仮説です。よく考えるAIほど、無駄な手順とやり直しが減る。だから深く考えさせたほうが、結果として枠の消費が少ないんじゃないか。設定を下げて節約するより、上げたほうが減らない、という逆転です。

ただし、一番上の「最大」まで上げると話が変わりました。慎重になりすぎて、チェックを増やしたり、やたら並列で動かしたりする。無駄な仕事まで全力でやるので、今度はかえって減ります。僕のちょうどいい所は「高い」の一段上で、一番上ではありませんでした。

一つだけ断っておくと、これは会社もモデルも違うAIでの体感で、同じ条件で比べた実験ではありません。速さのモードが8倍で減るのは公式の数字ですが、深く考えさせると減りにくいのは、僕の手元でそう見えている、という段階です。


枠を減らしていたのは、たぶん僕のほうだった

ここで白状しておくと、その「減らなかった夜」、僕は翌日のリセットに向けて、枠を使い切ろうとしていました。7つ並列で動かしながら、です。それでも減らなかった。

その2週間半ほど前、僕はまったく逆のことを記録しています。枠がリセットされると、使い切らないといけない気がしてくる。そうすると、本当は要らない作業までAIにやらせて、出来がいまいちだったら直させて、終わったらまた別のことをやらせる。AIを使うこと自体が目的になって、結果につながらない。だから上限が来たら休むか、走るか、考える時間にあてて、解除されたらためたアイデアを一気にやらせたほうがいい。そう書いていました。

書いた本人が、半月後に同じことをやっていたわけです。

前のプランの頃は、枠が足りずにリセットを何回か買い足したこともあります。でもこの2日間で見えたのは、枠の減り方を大きく動かすのが、プランの大きさより、速さのモードと考える深さの設定だったことです。そこに、使い切らなきゃという焦りで足す仕事が乗ると、減り方はさらに読めなくなります。


プランを上げる前に、手元で確かめること

僕の失敗から、上限によく当たる人が試せることを並べます。

  • 速さの設定を見る。 FastやUltrafastが入っていないか確かめます。入っていたら、その間は2.5倍、8倍で枠が減っています。急ぐ1本だけ入れて、終わったら戻す。
  • 1回の仕事で何%減ったかをメモする。 頼む前と後でメーターを見るだけです。僕が「20分で61%」とすぐ言えたのは、たまたま見ていたからでした。数字があると、モードや設定の違いを自分の使い方で比べられます。
  • 節約のつもりで考える深さを下げる前に、一段上げて比べる。 やり直しが多い仕事ほど、上げたほうが減らないことがあります。ただし一番上は、余計な仕事が増えることもあります。
  • 上限が来たら止める。 使い切るための仕事を足さない。止まっている間に、次に頼むことを考えておきます。

プランを上げる、リセットを買う、アカウントを増やす。上限に当たったときに一番最初に浮かぶのはお金で解決する方法ですが、そっちは最後で十分です。


僕の次の判断

Ultrafastの結論は、今のままだと使えない、です。期待していたぶん、がっかりしました。X(旧Twitter)にも悲観的な声が多かったんですが、自分で使ってみて、そうだろうなと思いました。

プランについてはまだ決めていません。この1か月で、上げたぶんの価値が出るか見ます。同じお金を別の会社のAIに回したほうが成果が大きいなら、プランを下げるつもりです。新しく出たものは使ってみて、使えるものは採用し、使えないものはフラットに切る。いつものやり方で判断します。

速いボタンは、押した瞬間は気持ちいいです。メーターを見るまでは。


制作プロセス

このコンテンツは、僕自身の一次情報をもとに制作しています。

出典1:作業よりも利用枠が超高速で減ってるじゃん
出典2:推論モードを上げた方が、逆にトークン効率がいいんじゃないか
出典3:容量がリセットされたら使い切らないといけない、という罠
出典4:月500ドルという噂で、OpenAIの値付けがうまいなと思った

AI活用

制作には、以下のAIモデルと僕の声をもとにしたAI音声を使用しています。

文章:Claude Opus 5.5
台本:Claude Opus 5.5
音声:Gemini 3.8 Flash TTS

ニュースレター

今週の大事な変化と、それをどう判断し、どう動いたかを毎週まとめています。

購読:Weekly Revolution