Gemini 3.5 Flash
5月20日のGoogle I/O 2026にて、待望の「Gemini 3.5 Flash」の登場がアナウンスされました。
実はこのアナウンスの少し前から、Antigravityのレスポンスが妙に高速になり 「お、やっと動作が安定してきたのかな?」
とAntigravityの明るい未来に喜んでいたのも束の間。
3.5 Flashの本格導入と同時に行われた「レート(クォータ)の改定」によって、これまで以上に肩身の狭い開発環境を強いられることになりました。
クォータの消費が3倍くらい速い
まず3.5 Flashは5時間のノルマを簡単に食い尽くします。

git fetch を行って少しPythonコードを書い頂いただけで、あっさりとクォータが枯渇し、数時間の待機です。
これと全く同様の作業であれば、前世代の Gemini 3.1 Flash では余裕で耐えてくれていたため、このあまりの「打たれ弱さ」には正直ビビりました。レスポンスが爆速(Flash)になった代わりに、枠の消滅スピードまで爆速になってしまったのです。
Flashを使うとProのレートも消費される
Flashを使うとProも消費されるというよくわからん状態です。
これは公式ドキュメント等でも説明されている通り、これまでの「モデル個別の独立した制限枠」が撤廃され、FlashとProのレート(プール)が完全に統合されたためと考えられます。
この統合というのが曲者です、ターミナル側の Antigravity CLI (Gemini CLI) も含まれるからです、なのでクォータが尽きるということはGoogleのAIがブラウザを除いて同時に使えないという状態を意味します。
オーバースペック気味なGemini
3.5 Flashの「頭脳の進化と引き換えに、大食いになった燃費の悪さ」は、まさにツールや仕様の過渡期特有の罠と言えます。
ぶっちゃけ、日々のちょっとしたコード修正やスクリプト作成程度の現在の作業内容なら、ここまで燃費の悪い最新モデルでなくても、もっとローコストで気兼ねなく使えるAIで十分なのですが、うーん、Liteモデルとか登場しないだろうか?
この状態ではAntigravityがどうすごいのか実感する前にノルマの壁が立ちはだかってしまうし、仮に猶予が5倍 20倍あっても変わらんのでは
3.5Flashはクォータの枯渇もFlash
6月に登場が噂されている「3.5 Pro」でこのあたりの燃費や制御が最適化されるのか、あるいはGoogle側が開発者コミュニティの悲鳴を受けてクォータの再調整を行うのか?
それまでは、不要なディレクトリを徹底的にスキャン対象から外す(.antigravityignore の徹底)など、こちらが「AIの無駄食い」を必死に縛る防衛策が必要になりそうです。
Googleの事なのでしれっと変えてくれそうですけど