Claude Opus 4.8
長文・コード・推論で定評。最上位は復帰した Fable 5、日常使いは新しい Sonnet 5、軽量は Haiku 4.5。
◎ 強み
- ◎ 長い文書をまとめるのが得意(1M tokens context)
- ◎ コード生成・修正の精度が高い(SWE-Bench で常時トップ争い)
- ◎ 安全側に振った穏やかな応答
- ◎ adaptive thinking で必要に応じて推論時間を自動調整
△ 注意点
- △ 画像生成はできない(読み取りのみ)
VS COMPARISON
Anthropic
Opus 4.8 / 2026-05-28
「Fable 5 級の頭脳をぐっと手頃に。実務の主戦力だよ」
Meta
Llama 4 Maverick (MoE 400B / 17B active, 128 experts) / 2025-04-05
「自前で動かせるオープン系の代表格」
編集部の総合判定
共通の公表ベンチマークがなく、数値では直接比較できない。料金と用途で選ぶのが正解
WHICH ONE
SPECS
| 項目 | Claude Opus 4.8 | Llama 4 Maverick |
|---|---|---|
| バージョン | Opus 4.8 | Llama 4 Maverick (MoE 400B / 17B active, 128 experts) |
| 公開日 | 2026-05-28 | 2025-04-05 |
| コンテキスト長 | 1000K | 1000K |
| 入力料金 $/1M | $5 安い | — |
| 出力料金 $/1M | $25 安い | — |
| 推論モデル | ✓ あり | — |
| マルチモーダル | ✓ あり | ✓ あり |
| AIコスパ指数 独自指標 | 64 | — |
BENCHMARKS
バーの長さは100%スケール。長い方が勝ち。
コード修正力(SWE-Bench)
知識の広さ(MMLU)
専門知識(GPQA)
※ SWE-Bench Verified(実OSSバグ修正)/ MMLU(総合学力)/ GPQA Diamond(博士レベル理系)/ AIME(数学オリンピック予選)
※「—」は未公表(実測0ではありません)。未公表の項目は勝敗のカウント対象外です。
PROS & CONS
長文・コード・推論で定評。最上位は復帰した Fable 5、日常使いは新しい Sonnet 5、軽量は Haiku 4.5。
◎ 強み
△ 注意点
Meta 製のオープンウェイト LLM。Llama 4 で MoE アーキ + native multimodal + 1M〜10M context へ進化。
◎ 強み
USE CASES
Claude Opus 4.8 か Llama 4 Maverick を取り上げてるタスク 7件
PRIMARY SOURCES
FAQ
Q. Claude Opus 4.8 と Llama 4 Maverick、結局どっちがいい?
A. 両モデルに共通する公表ベンチマークがないため、数値での優劣は付けられません(未公表は実測0ではありません)。料金と、下の強み・注意点の欄で用途に合うほうを選ぶのがおすすめです。
Q. Claude Opus 4.8 と Llama 4 Maverick、ベンチマークで強いのはどっち?
A. 共通の公表ベンチマークがないため、数値での直接比較はできません。各モデルが公表しているベンチマークは系統が異なるため、それぞれの一次ソースを参照してください。
Q. Claude Opus 4.8 と Llama 4 Maverick、初心者にはどっちがおすすめ?
A. 初心者へのおすすめ度は Claude Opus 4.8 の方が高め(4/5 対 2/5)。まず触ってみるなら Claude Opus 4.8 から始めると迷いにくいです。
更新を受け取る