ベンチマーク 🔥 HOT
AIコスパ指数とは?
別名: AI コスパ指数 / コスパ指数 / AI Cospa Index
ai-garage 編集部の独自統合スコア。第三者機関の知能スコアと料金の安さを 6:4 で加重し、値が大きいほど「安くて賢い」ことを表す(0〜100の整数)。
⚡ 30秒でわかる
AIコスパ指数 の主なポイント
- 1 「知能6:価格4」で加重した ai-garage 独自の統合コスパスコア(0〜100の整数)
- 2 知能スコアは第三者機関 Artificial Analysis の Intelligence Index v4.1 を採用(中立性重視)
- 3 料金は入力3:出力1のブレンド料金を対数スケールで評価(対象中の最安=100・最高=0)
- 4 提供停止中・料金非公開のモデルは対象外(例:Llama 4 Maverick は API 料金未公表で除外)
- 5 2026年7月時点は Grok 4.5 が最高・Mistral Large 3 が最低。毎月再集計
📖 詳しく
AIコスパ指数 とは
AIコスパ指数は、ai-garage 編集部が独自に算出する統合スコアです。「どれだけ賢いか(知能)」と「どれだけ安いか(料金)」を1つの数値にまとめ、値が大きいほど「安くて賢い=コスパが高い」ことを表します(0〜100の整数)。
知能スコアには、第三者機関 Artificial Analysis の Intelligence Index v4.1(9種類の評価を加重平均:エージェント34%/コーディング24%/科学推論24%/一般18%)を採用します。編集部の主観ベンチではなく外部の独立測定を用いることで、中立性を担保しています。
算出式は次のとおりです(対象=提供停止中でなく、AA Index と入力・出力の両料金が公開されているモデル):
・ブレンド料金 =(入力単価 × 3 + 出力単価 × 1)÷ 4(AA と同じ入力3:出力1の加重)
・知能スコア = そのモデルの AA Index ÷ 対象中の最高 AA Index × 100(最高知能を100とした相対値)
・価格スコア = 対象中の最安を100・最高を0とした対数スケール上の位置
・AIコスパ指数 = round(知能スコア × 0.6 + 価格スコア × 0.4)(知能6:価格4の編集部重み付け)
全モデルの実際の指数は「AIモデル比較表(/compare/)」に、価格×知能スコアの散布図は「コスパマトリクス(/matrix/)」に掲載しています。2026年7月時点では Grok 4.5 が最高値、Mistral Large 3 が最低値。数値は毎月再集計します。
❓ FAQ
よくある質問
- Q. AIコスパ指数はどうやって計算しているの?
- A. 第三者機関 Artificial Analysis の Intelligence Index v4.1 を知能スコア(最高知能を100とした相対値)とし、 料金の安さ(入力3:出力1のブレンド料金の対数スケール)と 6:4 で加重平均して算出します。 値が大きいほど「安くて賢い」ことを表します。
- Q. なぜ自前のベンチマークではなく Artificial Analysis を使うの?
- A. 編集部の主観や測定ばらつきを避け、中立性を担保するためです。 Artificial Analysis は9種類の評価を加重平均した独立指標で、各モデルを同一条件で比較できます。
- Q. 料金が安いだけのモデルが1位にならないのはなぜ?
- A. 知能を6割・価格を4割で重み付けしているためです。極端に安くても知能スコアが低いモデル(例:Mistral Large 3)は上位に来ません。 逆に高知能でも高価格だと価格スコアが下がります。
- Q. どのモデルが対象外になるの?
- A. 提供停止中のモデルや、API 料金が公開されていないモデル(例:Llama 4 Maverick)は算出対象外です。
🔗 関連