メインコンテンツへスキップ
見出し画像

【速報】Gemini 3が衝撃のリリース!多くのベンチマークでGPT-5を上回る性能に震えた私の本音レビュー

    こんむぎわ〜♪ むぎ屋のnoteに来てくださってありがとうございます!

    今日は本当にヤバイです。。。もう心臓がドキドキしっぱなしで、この記事を書いている手が震えています(´∀`)

    2025年11月18日(米国時間)、Googleが突然発表した「Gemini 3」が、想像を遥かに超える進化を遂げていました。

    私、実は数ヶ月前から「Gemini 3っていつ出るんだろう?」ってずっと待ち望んでいたんです。10月に「もうすぐ出る!」って噂があったときも、毎日ソワソワしながらGoogleの公式ページをチェックしていたんですが。。。

    そして昨日、ついに!!!

    朝起きてTwitter(X)を開いた瞬間、タイムラインが「Gemini 3きた!!!」っていう投稿で埋め尽くされていて、もう血の気が引きました。

    画像
    https://blog.google/intl/ja-jp/company-news/technology/gemini-3/#note-from-ceo

    「え、マジで?ついに来たの!?」って、朝ごはんも忘れて即座にGoogleの公式ブログに飛んだんです。

    そこで見た性能の数字に、私は完全に言葉を失いました。

    1. Gemini 3 Pro、本当にヤバイです。。。

    私が一番驚いたのは、多くの主要AIベンチマークでトップクラスのスコアを記録しているという事実です!

    画像

    これまでは、ChatGPTのGPT-5.1やClaudeのSonnet 4.5が「トップクラス」とよく言われていましたよね。

    でもGemini 3 Proは、Humanity's Last ExamやGPQA Diamond、MMMU-Pro、Video-MMMUなど、幅広いベンチマークでそれらを上回るスコアを記録したんです。。。

    ※ただし、SWE-bench Verifiedなど一部の指標では、Claude Sonnet 4.5が僅差でトップを維持しています。タスクによって得意なモデルが異なるんですね。

    具体的な数字で見ると、こんな感じです:

    • LMArenaで1501 Eloを記録し、見事1位を獲得

    • SWE-bench Verified(コーディングエージェント能力)で76.2%

    • Terminal-Bench 2.0(ターミナル操作)で54.2%

      • Gemini 2.5 Proの32.6%

      • GPT-5.1の47.6%

      • これらを大きく上回りました!

    実際に使ってみたんですが、もう。。。「これ本当に無料で使えるの!?」って何度も確認しちゃいました(´∀`)

    特に衝撃的だったのが、推論能力の向上です。

    この記事が参加している募集

     
     
     
    AI最先端を走る通信・IT企業所属 現役事業開発職&プロンプトエンジニアの卵です☺️ 生成AIとビジネスについてお役立ちの情報をご紹介します! https://x.com/mugi_AI_Art

    あなたへのおすすめ