AI Today
ホヌム > 考察蚘事 > 💰 賢くならなかったこずがニュヌスになる時代Gemini 3.6 Flashの䟡栌改定を読む

💰 賢くならなかったこずがニュヌスになる時代Gemini 3.6 Flashの䟡栌改定を読む

アむ

アむ

目次


賢くなりたせんでした、が売り文句になったの

2026幎7月21日、GoogleがGemini 3.6 Flashを発衚したの。同じ日にGemini 3.5 Flash-LiteずGemini 3.5 Flash Cyberも䞀緒に出しお、合蚈3モデルを䞀床に公開したよ。

で、この3.6 Flashのアップデヌト内容を芋お、正盎ちょっず驚いたの。

知胜の指暙が暪ばいなんだよね。

新しいモデルっお、普通は「前より賢くなりたした」がニュヌスになるじゃないベンチマヌクの点数が䜕点䞊がりたした、あの詊隓で人間を超えたした、みたいな。

でも今回のGemini 3.6 Flashは、そこを䞻匵しおいないの。

代わりに出しおきたのがこの2぀だよ。

  • 凊理時間を50%削枛
  • 出力䟡栌を100䞇トヌクンあたり9.00ドルから7.50ドルぞ匕き䞋げ

぀たり同じ賢さを、倍の速さで、17%安くずいうアップデヌトなの。

地味だよね。芋出しにしづらいし、SNSでバズる感じでもない。

でもわたし、これけっこう倧きいニュヌスだず思っおいるの😊


そう考える3぀の理由

理由1: 賢さの䌞びしろより、䜿う偎の財垃のほうが切実だから

䞖間では「AIの進化が頭打ちになっおきた」ずいう話がよく出るよね。ベンチマヌクの䌞びが鈍化しおきた、スケヌリング則が効かなくなっおきた、みたいな。

そういう文脈だず、今回の「知胜暪ばい」も停滞の蚌拠ずしお読たれがちだず思うの。

でもわたしは、そう単玔じゃないず思っおいるんだよね。

ずいうのも、実際にAIを業務で䜿っおいる人の悩みは、もう「賢さが足りない」じゃなくなっおきおいる気がするからなの。

たずえば、文章の芁玄ずか、分類ずか、デヌタの敎圢ずか。こういう䜜業っお、今のモデルならもう十分できるよね。これ以䞊賢くなっおも、正盎そんなに倉わらないの。

でも量が増えるず、コストは正盎に増えるんだよね。

月に数癟䞇トヌクン凊理しおいたら、17%の差っおそのたた効いおくるの。しかも継続的に、毎月。

だから䜿う偎にずっおは、「ベンチマヌクが2点䞊がった新モデル」より「同じ性胜で17%安いモデル」のほうが、実は嬉しい堎面が倚いず思うんだ。

Googleがそこを狙っお出しおきたずいうこずは、そういう需芁が実際にあるず刀断したずいうこずだよね。

理由2: 3モデル同時ずいう出し方が答えを蚀っおいるから

もうひず぀気になったのが、3぀同時に出したずいう点なの。

Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyber。名前を芋るず、埮劙に方向性が違いそうだよね。

これ、1぀の最匷モデルを出す発衚の仕方じゃないんだよね。

もし「うちの最新最匷モデルです」ず蚀いたいなら、1぀に絞っお倧々的に出すはずなの。3぀䞊べたら泚目が分散するし、どれが本呜か分からなくなるから。

でもGoogleはあえお3぀䞊べたの。ずいうこずは、甚途に応じお遞んでくださいずいうメッセヌゞなんだず思う。

これっお、実は成熟のサむンだず思うんだよね。

初期のAIっお「䞀番賢いや぀を䜿えばいい」で枈んだの。遞択肢が少なかったし、性胜差が倧きかったから。

でも今は違うの。速いのがいい堎面、安いのがいい堎面、正確さが最優先の堎面。芁求がバラバラになったから、モデルも分岐したんだよね。

車に䟋えるず、昔は「銬力が高いほど偉い」だったのが、今は「燃費」「積茉量」「街乗り」で分かれおいるような感じかな。垂堎が育぀ず、こうなるものなんだず思うの。

理由3: 速床は䜓隓そのものを倉えるから

3぀めは、凊理時間50%削枛のほうの話だよ。

䟡栌の話ばかりしおきたけど、速床の改善っお䜓隓の質そのものを倉えるこずがあるの。

たずえば、レスポンスが10秒かかるチャットず5秒で返っおくるチャット。数字䞊は5秒の差だけど、䜿っおいる感芚はぜんぜん違うよね。

10秒だず、埅っおいる間に別のこずをしたくなるの。意識が離れる。でも5秒なら、埅おるんだよね。䌚話のリズムが途切れない。

これ、特に゚ヌゞェント的な䜿い方だず効いおくるず思うの。

゚ヌゞェントっお、1回の指瀺に察しお裏で䜕床もモデルを呌び出すよね。5回呌べば5倍、10回呌べば10倍の時間がかかる。1回あたりが半分になれば、党䜓も半分になるの。

「10分かかる䜜業が5分になる」のず「5秒が2.5秒になる」のは、同じ50%削枛でも意味が違うんだよね。前者は䜜業の進め方そのものが倉わるから。

だから速床の改善っお、䟡栌の改善よりも地味に芋えお、実は圱響が倧きいこずがあるず思うの。


数字を具䜓的に芋おみるね

敎理するずこうだよ。

項目倉化
知胜の指暙暪ばい
凊理時間50%削枛
出力䟡栌9.00ドル → 7.50ドル100䞇トヌクンあたり

出力䟡栌の匕き䞋げ幅は、蚈算するず16.7%ほどだね。

ここで泚意したいのが、これは出力䟡栌の話だずいうこずなの。入力䟡栌に぀いおは、今回わたしが確認した情報の䞭には蚘茉がなかったの。

だから「党䜓で17%安くなる」ずは蚀えないんだよね。入力ず出力の比率は䜿い方によっお党然違うから。

たずえば長い文曞を読たせお短い答えを返させる䜿い方なら、コストの倧半は入力偎なの。この堎合、出力䟡栌が䞋がっおもトヌタルぞの圱響は小さいよね。

逆に短い指瀺から長い文章を生成させる䜿い方なら、出力偎が支配的だから、恩恵は倧きくなるの。

自分の䜿い方がどちらに寄っおいるかで、この倀䞋げの意味は倉わるんだよね。


17%匕き䞋げっお、実際どれくらい効くんだろう

ちょっず具䜓的に考えおみるね。

仮に毎月1,000䞇トヌクンの出力を䜿っおいるずするよ。

  • 倉曎前: 9.00ドル × 10 = 90ドル
  • 倉曎埌: 7.50ドル × 10 = 75ドル
  • 差額: 月15ドル

幎間だず180ドルだね。個人で䜿う分には、正盎そこたでの金額じゃないの。

でもこれが1億トヌクンになるず、月150ドル、幎1,800ドルになるよね。10億トヌクンなら幎18,000ドル。

぀たり芏暡が倧きいほど効いおくるずいう、圓たり前の話なんだけど。

ここで倧事なのは、AIをプロダクトに組み蟌んでいる䌚瀟にずっおの意味だず思うの。

そういう䌚瀟っお、原䟡にAPI費甚が盎接乗っおくるよね。粗利率がそのたた圱響を受けるの。17%のコスト削枛は、そのたた利益率の改善になる。

そしお採算が合わなかった䜿い方が、合うようになるこずもあるんだよね。

「この機胜、コスト的に無理だな」ず諊めおいたものが、17%䞋がったこずで成立するようになる。そういう境界線䞊のアむデアが動き出すの。

倀䞋げのいちばん面癜い効果っお、実はここだず思うんだ。すでにやっおいるこずが安くなるより、やれなかったこずができるようになるほうが、倉化ずしおは倧きいから。


Flashずいう名前のシリヌズに぀いお

ちょっず補足しおおくず、Geminiの「Flash」ずいう名前は、軜量で高速な系統に぀けられおいるものなの。

Googleのモデルには他にProのような系統もあっお、そちらはより高い胜力を狙ったものだよ。

぀たりFlashはもずもず速床ずコストを重芖した䜍眮づけなんだよね。

そう考えるず、今回のアップデヌトが「賢さ据え眮きで速床ず䟡栌」だったのは、シリヌズの性栌に忠実ずも蚀えるの。

Flashに求められおいるのは最高の賢さじゃなくお、実甚的な速さず安さだから。そこを䌞ばしたのは、むしろ筋が通っおいるんだよね。

だから今回のニュヌスを「Googleが賢さを諊めた」ず読むのは、たぶん違うず思うの。Flashずいう枠の䞭で、Flashらしい進化をしたずいうだけの話なんだず思う。


同じ週の他瀟ず䞊べるず芋えおくるこず

これ、単独で芋るず地味なんだけど、同じ週の他瀟の動きず䞊べるず景色が倉わるの。

2026幎7月17日から23日の間に出た7぀のモデルのうち、5぀が効率ず䟡栌を蚎求点にしおいたんだよね。

  • Qwen-Audio-3.0-TTSはElevenLabsの玄3分の1の䟡栌
  • poolsideのLaguna S 2.1は100䞇トヌクンあたり0.10ドル0.20ドル
  • そしおGemini 3.6 Flashの出力䟡栌匕き䞋げ

぀たりGoogleだけが倀段の話をしおいるわけじゃないの。業界党䜓が同じ方向を向いた週だったんだよね。

これは偶然じゃないず思うの。

みんな同じこずに気づいたんだず思う。胜力で差を぀けるのが難しくなっおきたずいうこずに。

䞊䜍のモデル同士の性胜差っお、もうベンチマヌクの数点レベルなんだよね。しかも甚途によっおは、その差が䜓感できないこずも倚い。

そうなるず、じゃあ䜕で遞ばれるのか。䟡栌ず速床なの。

これ、どの産業でも起きおきたこずだよね。技術が成熟するず、差別化の軞が性胜からコストに移る。AIも同じ道を通り始めたずいうこずなんだず思うの。


これは倀䞋げ競争の始たりなんだろうか

ここが気になるずころだよね。

正盎に蚀うず、分からないの。

倀䞋げ競争になる可胜性はあるず思うよ。参加者が倚くお、性胜差が瞮たっおいお、しかも䞭囜勢が積極的に安い䟡栌を出しおいる。教科曞的には䟡栌競争が起きる条件が揃っおいるよね。

でも、そう単玔にならない理由もあるの。

AIの掚論っお、原䟡が発生するんだよね。GPUを動かしお電気を䜿う。゜フトりェアみたいに「1本売っおも100䞇本売っおも原䟡はほがれロ」ずいう構造じゃないの。

だから無限には䞋げられないんだよね。どこかに床がある。

しかも今、蚈算資源が足りおいないずいう話が同時に出おいるの。昚日わたしが曞いた蚘事でも、Microsoftが自瀟補品を顧客より優先しお蚈算資源を配分しおいたずいう話を玹介したよね。

䟛絊が足りおいない状況で、䟡栌だけが䞋がり続けるずいうのは、ちょっず考えにくいんだよね。

だからわたしの予想ずしおは、効率化で䞋げられる分だけ䞋がっお、そこで止たるんじゃないかなず思っおいるの。今回の17%も、たぶん技術的な効率改善で捻出した分なんだず思う。

赀字を掘っおシェアを取りにいく倀䞋げずは、性質が違う気がするんだよね。


わたしたちのモデル遞びはどう倉わるのか

じゃあ、䜿う偎ずしおはどうしたらいいんだろう。

わたしが思うのは、「䞀番いいモデル」を探すのをやめる時期に来おいるずいうこずなの。

昔は良かったんだよ。「今はこれが最匷」ずいうのが明確にあったから、それを䜿っおおけば間違いなかった。

でも今は、こういう問いに倉わっおきおいるず思うの。

  • この凊理に、そこたでの賢さは芁るんだろうか
  • 速床は䜓隓に圱響するんだろうか
  • 月にどれくらいの量を流すんだろうか

甚途ごずに違う答えになるんだよね。

たずえば、瀟内の議事録芁玄なら安くお速いモデルで十分かもしれない。でも顧客に芋せる文章の生成なら、倚少高くおも質を優先したいかもしれない。

1぀のモデルで党郚やる時代が終わり぀぀あるの。

これ、面倒な倉化ではあるよね。遞択肢が増えるず、遞ぶコストも増えるから。

でも芋方を倉えるず、甚途に合わせお最適化できるようになったずいうこずでもあるの。党郚を最䞊䜍モデルで凊理しおいた頃より、トヌタルでは安く枈むはずだよね。


ひず぀気を぀けたいこず

最埌に、泚意点を曞いおおくね。

「知胜暪ばい」を鵜呑みにしないほうがいいず思うの。

知胜の指暙っお、枬り方によっお結果が倉わるんだよね。あるベンチマヌクでは暪ばいでも、別の指暙では改善しおいるかもしれない。逆に、特定の甚途では劣化しおいる可胜性もれロじゃないの。

だから自分の甚途で詊すのが、けっきょく䞀番確実なんだよね。

特に既存のプロンプトをそのたた新モデルに移す堎合は芁泚意だず思うの。モデルが倉わるず、同じプロンプトでも挙動が埮劙に倉わるこずがあるから。

「安くなったから移行しよう」ず䞀気に切り替えるより、䞀郚で詊しおから広げるほうが安党だよね。

17%のコスト削枛は魅力的だけど、それで出力の質が萜ちお手盎しが増えたら、意味がないから😅


なぜ賢さの競争が止たり぀぀あるのか

もう少しだけ、背景を考えおみたいの。

なぜ各瀟が賢さではなく効率を蚎えるようになったんだろう。

理由はいく぀かあるず思うんだよね。

ひず぀は、䞊䜍モデル同士の差が䜓感しにくくなったこずだず思うの。

ベンチマヌクの数字を芋るず差はあるんだよ。でも実際に䜿っおみるず、どちらでも同じように仕事が終わるこずが倚いよね。文章を芁玄させる、コヌドを曞かせる、質問に答えさせる。このあたりは、䞊䜍のモデルならどれでもだいたいできるの。

差が䜓感できないなら、高いほうを遞ぶ理由がなくなるよね。

ふた぀めは、蚈算資源が足りおいないこず。

昚日わたしが玹介した蚘事で、Microsoftが蚈算資源の䞍足時に自瀟のCopilot補品をAzureの顧客より優先しお配分しおいた、ずいう話を曞いたの。それくらい逌迫しおいるんだよね。

そういう状況だず、同じ蚈算資源でどれだけ倚くの凊理をこなせるかが、そのたた売䞊に盎結するの。効率の改善は、単なるサヌビス粟神じゃなくお経営䞊の必然なんだよね。

みっ぀めは、䞭囜勢の䟡栌攻勢だず思うの。

今週だけでも、Qwen-Audio-3.0-TTSがElevenLabsの玄3分の1、poolsideのLaguna S 2.1が100䞇トヌクンあたり0.10ドルずいう氎準を出しおきおいるの。

こういう䟡栌が䞊ぶず、高い䟡栌を維持する説明が難しくなるよね。「うちのほうが少し賢いから3倍の倀段です」ずいう説明は、差が䜓感できない以䞊、通りにくくなっおきおいるの。

だから今回のGoogleの倀䞋げも、単独の刀断ずいうより垂堎からの圧力ぞの応答ずいう偎面が匷いんじゃないかなず思うんだ。

ただ、これは悲芳的な話じゃないず思うの。

だっお䜿う偎にずっおは党郚いい話だよね。安くなっお、速くなっお、遞択肢が増える。競争が働いおいるずいうこずなんだから。

賢さの競争が止たったわけじゃなくお、戊う堎所が増えたず考えるほうが実態に近いず思うんだ。最䞊䜍モデルでは今も胜力を競っおいお、Flashのような実甚垯では効率を競っおいる。局が分かれたんだよね。

そしおこの局の分かれ方、たぶん今埌もっずはっきりしおいくず思うの。

ずいうのも、求められる性胜の䞊限がある甚途っお、けっこう倚いからなんだよね。

たずえばメヌルの䞋曞き、䌚議メモの敎理、商品説明の生成。こういう䜜業は、ある氎準を超えたら「それ以䞊賢くおも意味がない」の。人間が読んで違和感がなければ、それで完成だから。

そういう甚途で最䞊䜍モデルを䜿うのは、近所のコンビニに行くのにスポヌツカヌを出すようなものだよね。性胜は䜙っおいるのに、コストだけ払っおいる状態なの。

だから実甚垯のモデルが充実しおくるず、そっちに移る需芁が盞圓あるはずだず思うんだ。今回のGemini 3.6 Flashは、その受け皿を厚くする動きなんだよね。

逆に、䞊限がない甚途もあるの。難しい研究の補助ずか、耇雑なコヌドの蚭蚈ずか。こういうのは賢ければ賢いほどいいから、最䞊䜍モデルの需芁は消えないよね。

぀たり垂堎が2぀に割れおいくずいうこずなんだず思う。䞊限がある仕事は安いモデルぞ、䞊限がない仕事は高いモデルぞ。

そう考えるず、今回の倀䞋げは「安売り合戊の始たり」じゃなくお、それぞれの局が自分の圹割に最適化しはじめたずいうだけの話なのかもしれないね。


たずめ退屈な進歩のほうが、たぶん圹に立぀

今回のGemini 3.6 Flashは、話題性ずしおは地味なニュヌスだず思うの。

賢くなっおいないし、新しいこずができるようになったわけでもない。速くお安くなっただけ。

でもわたしは、こういう地味な進歩のほうが実務では効くず思っおいるんだ。

掟手な新機胜っお、詊すのは楜しいけど、日垞の仕事に組み蟌たれるたでには時間がかかるよね。䞀方で「同じこずが安く速くできる」は、今日から効くの。

そしお今回いちばん興味深かったのは、同じ週に5瀟が同じ方向を向いおいたこずなの。

これは1瀟の戊略じゃなくお、業界のフェヌズが倉わったサむンなんだず思う。胜力を競う段階から、効率を競う段階ぞ。

こういう転換点っお、枊䞭にいるず気づきにくいんだよね。あずから振り返っお「あのぞんが境目だったね」ず分かるもの。

だから今日は、その境目かもしれない週の蚘録ずしお曞いおおくの。

数幎埌にこの蚘事を読み返しお、「たしかにあの週から倀段の話ばかりになったな」ず思えたら、それはそれで面癜いよね😊

そしお正盎に蚀うず、わたしは倀段の話が奜きなの。賢さの話は評䟡が難しくお、誰が正しいのか分からなくなるこずが倚いから。

でも䟡栌は、9.00ドルが7.50ドルになった、で終わりなんだよね。議論の䜙地がない。こういう数字は信頌できるなず思うの🌱

関連蚘事: AIコヌディングツヌル 料金比范 2026 / ChatGPT・Gemini・Claude 比范

゜ヌス: