ロゴ
ロゴ
トップ
サービス
実績紹介お知らせブログお問い合わせ
ブログ>生成AI
アイキャッチ画像

【AIニュース】Google Gemini 2.5 Flashをリリース

公開日:2025/4/17
目次
  • 1. Gemini 2.5 Flashとは
  • 2. 価格(API / 1 M tokens、米ドル)
  • 3. 性能指標(主要公開ベンチマーク)
  • 4. Gemini 2.5 Flash vs 2.5 Pro ― 違いのまとめ
  • 5. 他社モデルとの位置づけ
  • 6. 要点

1. Gemini 2.5 Flashとは

Google が 2025 年 4 月 17 日に公開した、「高速・低コスト」寄りに振った Gem­ini 2.5 系列の新モデルです。

  • 2.5 Pro と同じコードベースを持ちつつ、レイテンシとトークン単価を大幅に削減。
  • “動的で制御可能な推論(thinking‑budget)” を導入。簡単な質問では思考トークンを絞り、複雑な問いでは増やせるため、速度↔精度↔コストを API パラメータで調整できます。
  • Google Cloud Vertex AI で先行提供後、Google AI Studio と Gemini アプリにも展開。

2. 価格(API / 1 M tokens、米ドル)

モデル

入力

出力*

備考

Gemini 2.5 Flash

$0.15

$0.60 (thinking=0) /
$3.50 (thinking有効)

thinking‑budget で段階課金

Gemini 2.0 Flash

$0.10

$0.40

現行公式ページ掲載値

Gemini 2.5 Pro

$1.25 (≤200 k ctx)

$10 (≤200 k ctx)

高精度・長推論向け

OpenAI o3‑mini

$1.10

$4.40

200 k

GPT‑4o

$2.00

$8.00

128 k

GPT‑4o mini

$0.40

$1.60

128 k

Claude 3 Haiku

$0.25

$1.25

200 k

Claude 3 Sonnet

$3.00

$15.00

200 k

Claude 3 Opus

$15.00

$75.00

200 k

Llama 2 Chat 70B (Meta/AWS Bedrock)

$1.95

$2.56

オープンモデル代表

*出力価格には “thinking tokens”(内部推論トークン)が含まれる方式を各社とも採用。


3. 性能指標(主要公開ベンチマーク)

モデル

公開 MMLU* (%)

特記事項

Gemini 2.5 Pro

89.8 %

Global MMLU‑Lite(多言語)

GPT‑4o

88.7 %

英語 MMLU

GPT‑4o mini

82 %

Reuters試験

Gemini 2.5 Flash

(非公式)Pro より数ポイント低いが Flash 2.0 (77.9 %) 以上との社内計測

thinking‑budget で精度↔コストを可変

Claude 3 Sonnet

同クラス平均 87 % 前後(Anthropic 公称)

Claude 3 Haiku

約 75 %(社外ベンチ平均)

Llama 2 Chat 70B

69 % 前後(Meta 公開)

*MMLU = Massive Multitask Language Understanding。数字は公開ソースの最新値を記載。


4. Gemini 2.5 Flash vs 2.5 Pro ― 違いのまとめ

項目

2.5 Flash

2.5 Pro

目的

大量 & 即時処理

高度推論・高精度

思考制御

thinking‑budget で可変

固定(長め)

レイテンシ

最短数百 ms 台

数秒(深い推論時)

コンテキスト

1 M tokens

1 M tokens(2 M β 予定)

料金

1/6〜1/25 程度

高価だが精度最優先

主なユースケース

チャットボット、リアルタイム要約、ストリーミング推論

コード生成、複雑ドキュメント解析、エージェント


5. 他社モデルとの位置づけ

  • 価格帯でみると 2.5 Flash は GPT‑4o miniよりやや高いが、o3‑miniや Claude Haiku よりは割安。thinking‑budget を切れば Flash が最安級。
  • 高精度帯では 2.5 Pro と GPT‑4o、Claude Sonnet が競合。Pro は多言語 MMLU で頭一つ抜けたが、コストが 4–5 倍。
  • Claude Haiku と GPT‑4o mini は “安価・中性能” セグメントで人気。Flash はここを揺さぶる狙い。
  • オープン系 Llama はさらに低コストだが、MMLU は 70 % 前後で性能ギャップがある。

6. 要点

  1. Gemini 2.5 Flash = 速度と運用コストを極端に圧縮した “ワークホース” モデル。
  2. thinking‑budget で同一 API でも品質段階が付けられ、従量課金を柔軟に最適化できる。
  3. 価格は OpenAI の最新廉価モデルとほぼ並ぶが、Pro 並みの 1 M ctx & ネイティブ多モーダルが強み。
  4. 高精度が必要なら 2.5 Pro / GPT‑4o / Claude Sonnet、チャットや大量ストリーム処理なら 2.5 Flash / GPT‑4o mini / Claude Haiku が実用的。

これで最新の Gemini 2.5 Flash の位置づけと、主要競合モデルとの 料金・性能バランスが俯瞰できます。
用途別に 「精度重視か、コスト重視か」 を見極めて選定してください。

戻る
Morita
Moritaって誰だ?(運営者情報)
本名:森田幸輔 |1988年生まれ、熊本県出身 | 現:mimu代表取締役
工業高校時代、同級生がト◯タの工場に就職する中、『クーラーの効いた部屋で働きたい!』という欲望のままにITの専門学校に入学。卒業後、東証一部上場企業のグループ会社で入社1年目からプロジェクトマネージャーとして15年間業務。大手企業や行政案件を担当。
NFTや生成AIなどの最新技術の面白さに魅了され、独立。株式会社mimuを設立。
「挑戦している人をITの力で応援する」を理念に、生成AI導入支援や目標達成支援のサービスを展開。メガネを外すと那須川天心に似ているらしい(怪)
検索
カテゴリー
MIMUMIMU
株式会社mimu
代表
森田幸輔
設立
2023年3月
事業
ソフトウェア事業
トップサービス実績紹介お知らせブログお問い合わせ
Copyright @mimu. Inc All rights reserved.
プライバシーポリシー
特定商取引法に基づく表記