Apple Intelligence / AI
Gemini 3.8 Flash登場。「長時間仕事をするAI」の時代がいよいよ始まった?
GoogleがGemini 3.8 Flashを発表。長時間のソフトウェア開発や自律型AIエージェントに向けた新モデルから、「仕事を任せられるAI」への競争を考えます。
りんご好きringozuki.comGoogleが「Gemini 3.8 Flash」を発表しました。
正直、最初にニュースを見た時に思ったのは、
「えっ、3.7 Flashって出たばっかりじゃなかった?」
です。
実際その通りで、Gemini 3.7 Flashが発表されたのはわずか3週間ほど前。
Googleによると、今回の3.8 Flashはわずか6週間で3回目となるFlashシリーズの更新です。
AIの進化が速いとはずっと言われてきましたが、さすがにこのペースには驚きます。
ただ、今回もっと気になったのはモデル番号ではありません。
GoogleがGemini 3.8 Flashを、
長時間のソフトウェア開発や自律型AIエージェント
にかなり明確に向けてきたことです。
AIが「質問すると答えてくれるもの」から、
仕事を渡したら、自分で考えながら長時間作業を続けるもの
へ変わり始めている。
今回の発表を見て、いよいよそんなフェーズに入ってきたのかなと思いました。
3.7からわずか3週間でGemini 3.8 Flash
Google DeepMindは9月2日、Gemini 3.8 Flashを正式発表しました。
Googleは3.8 Flashを、これまでで最も優れた推論・コーディングモデルと位置付けています。
特に強化されたのが、
* ソフトウェアエンジニアリング
* AIエージェントによる作業
* 複雑な複数ステップの推論
* 長時間にわたるソフトウェア開発
といった分野です。
Google DeepMindのモデルページでも、Gemini 3.8 Flashは「複雑なエージェントタスクを大規模に処理する用途」に適したモデルとして紹介されています。
最大100万トークンの入力に対応し、Function Calling、検索、Computer Useなどのツール利用にも対応します。
つまり、ただコードを生成するだけではなく、
調べる。
ツールを使う。
結果を見る。
間違っていれば修正する。
そしてまた作業を続ける。
そんなAIエージェントとしての使い方が、かなり重要になってきています。
Google自身が「長時間のコーディング」を前面に出している
今回かなり象徴的だと思ったのが、Google自身がGemini 3.8 Flashを「long-horizon coding and autonomous agents」向けとして紹介していることです。
long-horizon。
つまり、一回質問して一回答えて終わるような仕事ではありません。
ある程度長い時間をかけて、複数の作業を続けながら一つの目的を達成する仕事です。
Googleが公開したDeepSWE v1.1という長時間ソフトウェア開発の評価では、Gemini 3.8 Flashが多くの大型フロンティアモデルを上回ったとしています。
もちろん、これはGoogle自身が公表している評価結果です。
実際の開発現場でどこまで安定して仕事を続けられるのかは、これからいろいろな人が使ってみないと分かりません。
それでもGoogleが今回、単純な「賢さ」だけではなく、
長時間仕事を続けられること
を強く打ち出しているのは、とても面白いと思います。
大手3社の競争も変わってきた
ここ最近のAIを見ていると、競争の内容そのものが少し変わってきたように感じます。
少し前までは、
「どのAIが一番賢い?」
「どのモデルのベンチマークが一番高い?」
という話が中心でした。
もちろん今でもモデル性能は重要です。
でも、実際にAIを仕事で使う側からすると、それだけでは足りません。
欲しいのは、
仕事を任せられるAI
なんですよね。
OpenAIにはCodexがあります。
AnthropicにはClaude Codeがあります。
そしてGoogleはAntigravityとGeminiをかなり強化しています。
3社とも方向は少しずつ違いますが、
「AIと会話する」
ところから、
「AIに仕事を渡す」
方向へ進んでいるように見えます。
僕自身も「AIに仕事をしてもらう」ことが増えた
これは僕自身、最近かなり感じています。
以前はAIに質問して、返ってきた答えを自分で使うことがほとんどでした。
でも今は違います。
ある程度まとまった仕事を渡して、
調べてもらう。
作ってもらう。
確認してもらう。
次の作業へ進んでもらう。
そんな使い方がどんどん増えています。
だからAIモデルの新製品を見た時も、最近は、
「ベンチマークが何点上がったのか」
より、
これ、どのくらい仕事を任せられるんだろう?
のほうが気になります。
Gemini 3.8 Flashも、まさにそこを狙ったモデルに見えます。
しかもFlashだから安い
もう一つ重要なのが価格です。
Gemini 3.8 Flashの導入価格は、
入力:100万トークンあたり0.75ドル
出力:100万トークンあたり3.75ドル
です。
これはGemini 3.7 Flashと同じ価格です。
ただし、この価格は2026年12月31日までの導入価格。
2027年1月1日からは、
入力:100万トークンあたり1.50ドル
出力:100万トークンあたり7.50ドル
になります。
それでも、長時間動くAIエージェントではコストがかなり重要です。
AIが数分答えるだけなら多少高くても問題ありません。
でも何十分、何時間とツールを使いながら作業するようになれば、利用するトークンも増えていきます。
だからGoogleが高性能モデルだけではなく、Flashシリーズでエージェント性能を強化しているのは重要だと思います。
すでにAntigravityなどで使える
Gemini 3.8 Flashは発表だけではなく、すでに提供が始まっています。
開発者はGoogle Antigravity、Gemini API、Google AI Studio、Android Studioなどから利用できます。
企業向けにはGemini Enterprise。
一般ユーザー向けにもGoogle AI Pro / Ultra契約者を対象に、Geminiアプリ、Google検索のAI Mode、Google Sheetsなどで提供されています。
つまり、「そのうち使えるようになるAI」ではありません。
すでに実際に使い始められる段階です。
次に欲しいのは「強力な長期記憶」
そしてここからは、完全に僕個人の期待です。
AIが長時間仕事を続けられるようになってきたら、次にものすごく欲しくなるものがあります。
長期記憶です。
例えばAIに仕事を頼んで、今日かなり良いところまで進んだとします。
翌日、
「昨日の続きお願い」
と言っただけで、
昨日何をやったのか。
何を決めたのか。
どこまで終わったのか。
次に何をすべきなのか。
全部理解した状態から、そのまま仕事を再開してほしい。
さらに理想を言えば、チャットが変わっても関係ない。
パソコンからスマホに変わっても関係ない。
プロジェクトごとの細かいルールも全部覚えている。
そうなった時、AIエージェントはかなり違う存在になると思います。
「チャットを使う」感覚そのものがなくなるかもしれない
今のAIは、まだ「チャットする」という感覚が強く残っています。
ChatGPTを開く。
Geminiを開く。
Claudeを開く。
そしてAIへ指示する。
でも、
長時間仕事を続けられる。
ツールを自分で使える。
過去の仕事を長期的に覚えている。
この3つが揃ったらどうなるでしょう。
もしかすると、
「AIとチャットする」という感覚自体が薄くなる
のかもしれません。
「これお願い」
と言えば仕事が始まり、
必要な時だけAIから確認が来て、
終わったら結果が返ってくる。
人間のスタッフへ仕事を頼むのと、少し近い感覚です。
僕自身が欲しいのも、まさにそんなAIです。
AIの競争は「誰が一番賢い?」から次へ
Gemini 3.8 Flashが実際にどこまで安定して長時間の仕事をこなせるのか。
これはまだ使ってみないと分かりません。
Google自身のベンチマークだけで判断するのも早いでしょう。
でも、今回の発表から見える方向性はかなりはっきりしています。
AIの競争が、
「誰が一番賢いモデルを作るか」
だけではなく、
誰が一番、実際の仕事を任せられるAIを作るか
へ進んできました。
そこに、強力な長期記憶まで加わったらどうなるのか。
AIに質問する時代から、
AIと一緒に仕事をする時代。
そしてその次は、
AIに仕事を任せる時代。
Gemini 3.8 Flashの発表を見ていると、その新しい時代がかなり近くまで来ているように感じます。
この記事をシェア
今回の主な情報源
- Google DeepMindIntroducing Gemini 3.8 Flash and 3.8 Flash Cyber↗
- Google DeepMindGemini 3.8 Flash↗
- Google DeepMindGemini 3.8 Flash Model Card↗
- Google AI for DevelopersGemini API pricing↗
※製品仕様・価格は発表時点の情報です。
