ai-garage
ベンチマーク 🔥 HOT

AIコスパ指数とは?

別名: AI コスパ指数 / コスパ指数 / AI Cospa Index

ai-garage 編集部の独自統合スコア。第三者機関の知能スコアと料金の安さを 6:4 で加重し、値が大きいほど「安くて賢い」ことを表す(0〜100の整数)。

⚡ 30秒でわかる

AIコスパ指数 の主なポイント

  • 1 「知能6:価格4」で加重した ai-garage 独自の統合コスパスコア(0〜100の整数)
  • 2 知能スコアは第三者機関 Artificial Analysis の Intelligence Index v4.1 を採用(中立性重視)
  • 3 料金は入力3:出力1のブレンド料金を対数スケールで評価(対象中の最安=100・最高=0)
  • 4 提供停止中・料金非公開のモデルは対象外(例:Llama 4 Maverick は API 料金未公表で除外)
  • 5 2026年7月時点は Grok 4.5 が最高・Mistral Large 3 が最低。毎月再集計

📖 詳しく

AIコスパ指数 とは

AIコスパ指数は、ai-garage 編集部が独自に算出する統合スコアです。「どれだけ賢いか(知能)」と「どれだけ安いか(料金)」を1つの数値にまとめ、値が大きいほど「安くて賢い=コスパが高い」ことを表します(0〜100の整数)。 知能スコアには、第三者機関 Artificial AnalysisIntelligence Index v4.1(9種類の評価を加重平均:エージェント34%/コーディング24%/科学推論24%/一般18%)を採用します。編集部の主観ベンチではなく外部の独立測定を用いることで、中立性を担保しています。 算出式は次のとおりです(対象=提供停止中でなく、AA Index と入力・出力の両料金が公開されているモデル): ・ブレンド料金 =(入力単価 × 3 + 出力単価 × 1)÷ 4(AA と同じ入力3:出力1の加重) ・知能スコア = そのモデルの AA Index ÷ 対象中の最高 AA Index × 100(最高知能を100とした相対値) ・価格スコア = 対象中の最安を100・最高を0とした対数スケール上の位置 ・AIコスパ指数 = round(知能スコア × 0.6 + 価格スコア × 0.4)(知能6:価格4の編集部重み付け) 全モデルの実際の指数は「AIモデル比較表(/compare/)」に、価格×知能スコアの散布図は「コスパマトリクス(/matrix/)」に掲載しています。2026年7月時点では Grok 4.5 が最高値、Mistral Large 3 が最低値。数値は毎月再集計します。

❓ FAQ

よくある質問

Q. AIコスパ指数はどうやって計算しているの?
A. 第三者機関 Artificial Analysis の Intelligence Index v4.1 を知能スコア(最高知能を100とした相対値)とし、 料金の安さ(入力3:出力1のブレンド料金の対数スケール)と 6:4 で加重平均して算出します。 値が大きいほど「安くて賢い」ことを表します。
Q. なぜ自前のベンチマークではなく Artificial Analysis を使うの?
A. 編集部の主観や測定ばらつきを避け、中立性を担保するためです。 Artificial Analysis は9種類の評価を加重平均した独立指標で、各モデルを同一条件で比較できます。
Q. 料金が安いだけのモデルが1位にならないのはなぜ?
A. 知能を6割・価格を4割で重み付けしているためです。極端に安くても知能スコアが低いモデル(例:Mistral Large 3)は上位に来ません。 逆に高知能でも高価格だと価格スコアが下がります。
Q. どのモデルが対象外になるの?
A. 提供停止中のモデルや、API 料金が公開されていないモデル(例:Llama 4 Maverick)は算出対象外です。

更新を受け取る