Anthropic最上位モデル。1Mコンテキスト、Agent Teams によるマルチエージェント協調をネイティブサポート。コーディング・エージェント操作・長文分析で最高性能。
AIモデル一覧
40件のモデルを掲載 · 最終更新 2026/06
コスパで俯瞰する
縦軸に性能、横軸に Output 価格(対数)。緑線は同価格帯で最高性能を更新するモデル群=パレートフロンティア。
Pareto Frontier
Model performance at each price point
- Pareto Optimal
- Reasoning
- Coding
- Multimodal
- Open / General
40 モデル一覧
40 件をスコア順に表示
- 01Claude Opus 4.6Anthropicimage-text-to-textGENERALllmScore1347Price$25.00Context1.0M
- 02Score1294Price$25.00Context200K
- 03Claude Sonnet 4.6Anthropicimage-text-to-text
コンピュータ操作・コーディング・デザイン・知識作業に優れたバランス型モデル。1Mコンテキスト対応。
GENERALllmScore1288Price$15.00Context1.0M - 04Claude Sonnet 4.5Anthropicimage-text-to-text
エージェント・コーディング・コンピュータ操作で世界最高水準のバランス型モデル。B2Bワークフローに最適化。
GENERALllmScore1235Price$15.00Context1.0M - 05Gemini 3 ProGoogle DeepMindvideo-text-to-text
Googleの最上位モデル。20中19のベンチマークでトップ性能、Deep Think推論機能搭載。1Mトークンコンテキスト。
GENERALmultimodalScore1219Price$12.00Context1.0M - 06GPT-5OpenAIimage-text-to-text
OpenAI第5世代フラッグシップ。複数サブモデル(main / mini / thinking / nano)のハイブリッド構成でタスクに応じて自動ルーティング。
GENERALllmScore1198Price$10.00Context400K - 07Claude Haiku 4.5Anthropicimage-text-to-text
最速・最コスト効率のモデル。Sonnet 4 相当の性能をコーディング・コンピュータ操作・エージェントタスクで発揮。
GENERALllmScore1173Price$5.00Context200K - 08DeepSeek-V3.2-ExpDeepSeektext-generation
deepseek-chat / deepseek-reasoner を統一する実験版モデル(V3.2-Exp、Hugging Face Hub: deepseek-ai/DeepSeek-V3.2-Exp)。128Kコンテキスト、圧倒的な低コスト。Thinkingモードで CoT 推論対応。
GENERALllmScore1085Price$0.42Context128K - 09Gemini 2.5 ProGoogle DeepMindvideo-text-to-text
Googleの最もインテリジェントなAIモデル(2025年前半時点)。思考モデルとして推論ステップを踏んでから応答。
GENERALmultimodalScore1021Price—Context1.0M - 10Score787Price—Context128K
- 11Claude Sonnet 5Anthropicimage-text-to-text
速度と知能のバランスに優れた最新Sonnet。Opus 4.8に迫る性能をより低価格で提供し、歴代Sonnetで最もエージェント的。適応思考(Adaptive Thinking)既定ON、1Mコンテキスト対応。導入価格 $2/$10(2026年8月31日まで、以降は標準 $3/$15)。
GENERALllmScore—Price$15.00Context1.0M - 12Claude Fable 5Anthropicimage-text-to-text
Anthropic初の一般提供Mythosクラスモデル。ほぼ全ベンチマークでSOTA。タスクが長く複雑なほど他モデルとの差が拡大。一部トピックはOpus 4.8へ安全フォールバックする設計。
GENERALllmScore—Price$50.00Context1.0M - 13Claude Opus 4.8Anthropicimage-text-to-text
Opusティア最上位。コード欠陥の指摘精度が4.7比4倍に向上し、Dynamic Workflows による並列サブエージェント実行と Effort Control に対応。OSWorld-Verified 83.4%。
GENERALllmScore—Price$25.00Context1.0M - 14Mistral Medium 3.5Mistral AIimage-text-to-text
Mistralの新フラッグシップ。指示追従・推論・コーディングを単一の128B denseモデルに統合し、SWE-Bench Verified 77.6%。修正MITライセンスのオープンウェイトで提供。
GENERALllmScore—Price$7.50Context256K - 15Gemini 3.5 FlashGoogle DeepMindvideo-text-to-text
Gemini 3.5世代の先行モデル。エージェント・コーディングタスクで上位のGemini 3.1 Proを上回り、出力トークン生成は同等フロンティアモデル比4倍高速。Terminal-Bench 2.1 76.2%。
GENERALllmScore—Price$9.00Context1.0M - 16GPT-5.5OpenAIimage-text-to-text
OpenAIフラッグシップ。GPT-5.4と同等のトークン毎レイテンシでより高い知能を実現。コーディング・リサーチ・データ分析・ドキュメント作成などプロフェッショナルワーク全般に最適化。
GENERALllmScore—Price$30.00Context1.1M - 17Qwen3.6-27BAlibaba Cloud (Qwen Team)video-text-to-text
Qwen3.6系初のオープンウェイト版。27B dense + Vision Encoder で、前世代の397B MoEフラッグシップをコーディングで上回るエージェンティックコーディング特化モデル。Gated DeltaNet と Gated Attention のハイブリッド構成。ネイティブ262Kコンテキスト(最大約1Mまで拡張可)、画像・動画理解に対応。Apache 2.0。
MULTIMODALmultimodalScore—Price—Context262K - 18Claude Opus 4.7Anthropicimage-text-to-text
高難度ソフトウェアエンジニアリングを強化したOpus。長辺2,576px(約3.75MP・従来比3倍超)の高解像度ビジョンと新トークナイザーを導入し、effort に xhigh を追加。
GENERALllmScore—Price$25.00Context1.0M - 19Gemma 4 E2BGoogle DeepMindimage-text-to-text
Gemma 4 最軽量エッジモデル(2Bクラス)。テキスト・画像・音声入力対応。128Kコンテキスト。超省電力・超低レイテンシ向け。Apache 2.0。
GENERALmultimodalScore—Price—Context128K - 20Gemma 4 E4BGoogle DeepMindimage-text-to-text
Gemma 4 エッジ向けモデル(4Bクラス)。テキスト・画像・音声入力対応。128Kコンテキスト。オンデバイス AI assistant 向け。Apache 2.0。
GENERALmultimodalScore—Price—Context128K - 21Gemma 4 26B A4BGoogle DeepMindimage-text-to-text
Gemma 4 MoE モデル。total 25.2B / active 3.8B の超効率設計で、31B に迫る品質を低コストで実現。Tau2 68.2 でエージェント性能も高い。Apache 2.0。
GENERALmultimodalScore—Price—Context256K - 22Gemma 4 31BGoogle DeepMindimage-text-to-text
Gemma 4 ファミリー最上位の Dense モデル。256Kコンテキスト、MMLU Pro 85.2・AIME 2026 89.2 など全ベンチマークで前世代を大幅に超越。Arena AI open-source text rank 3。Apache 2.0。
GENERALmultimodalScore—Price—Context256K - 23Mistral Small 4Mistral AIimage-text-to-text
Magistral(推論)・Pixtral(マルチモーダル)・Devstral(コーディング)を単一モデルに統合した初のMistralモデル。119B総パラメータ(6Bアクティブ)のMoEでApache 2.0提供。
GENERALllmScore—Price$0.30Context256K - 24GPT-5.4OpenAIimage-text-to-text
プロフェッショナルワーク向けフロンティアモデル。OSWorld-Verified / WebArena Verified で当時最高記録、GDPval 83%。Tool Search によるツール定義の遅延解決を導入。
GENERALllmScore—Price$15.00Context1.1M - 25Gemini 3.1 ProGoogle DeepMindvideo-text-to-text
Gemini 3 Proの推論強化版。ARC-AGI-2 検証スコア77.1%で3 Proの2倍超の推論性能。複雑なシステム統合やコード生成(アニメーションSVG・3D可視化)に強い。
GENERALllmScore—Price—Context— - 26Qwen3.5-397B-A17BAlibaba Cloud (Qwen Team)text-generation
Qwen最新世代MoEモデル。397B総パラメータ、17Bアクティブ。Apache 2.0ライセンスで公開。
GENERALllmScore—Price—Context— - 27GPT-5.3 CodexOpenAIimage-text-to-text
GPT-5.3のコーディング特化バリアント。400Kコンテキスト、128K出力対応。エージェント型コーディングに最適。
GENERALllmScore—Price—Context400K - 28Gemini 3 FlashGoogle DeepMindvideo-text-to-text
フロンティア知能を高速・低コストで提供するモデル。Gemini 2.5 Flashの後継。
GENERALmultimodalScore—Price$3.00Context1.0M - 29GPT-5.2OpenAIimage-text-to-text
OpenAIのフラッグシップモデル。Instant / Thinking / Pro の3バリアント構成。400Kコンテキスト、AIME 2025 数学ベンチマーク100%達成。
GENERALllmScore—Price$14.00Context400K - 30Mistral Large 3Mistral AIimage-text-to-text
Mistral最大のオープンウェイトMoEモデル。675B総パラメータ、41Bアクティブ。256Kコンテキスト。Apache 2.0ライセンス。
GENERALmultimodalScore—Price$1.50Context256K - 31Gemini 3 Deep ThinkGoogle DeepMindimage-text-to-text
最先端の科学・研究・エンジニアリング課題向け深層推論モデル。2026年2月に大規模アップデート。
GENERALllmScore—Price—Context1.0M - 32Score—Price—Context400K
- 33Gemini 2.5 FlashGoogle DeepMindvideo-text-to-text
高速・コスト効率に優れた思考モデル。Google I/O 2025でデフォルトモデルに採用。
GENERALmultimodalScore—Price—Context1.0M - 34Score—Price$2.00Context131K
- 35Qwen3-30B-A3BAlibaba Cloud (Qwen Team)text-generation
軽量MoEモデル。QwQ-32Bを上回る性能を10分の1のアクティブパラメータで達成。
GENERALllmScore—Price—Context— - 36Qwen3-235B-A22BAlibaba Cloud (Qwen Team)text-generation
Alibaba Qwen3 フラッグシップMoE。235B総パラメータ、22Bアクティブ。36兆トークンで学習、119言語対応。1Mトークンコンテキスト。
GENERALllmScore—Price—Context1.0M - 37Llama 4 MaverickMeta AIimage-text-to-text
128エキスパートMoEの大規模オープンウェイトモデル。1Mトークンコンテキスト。GPT-4oやGemini 2.0 Flashを上回るマルチモーダル性能。
GENERALmultimodalScore—Price—Context1.0M - 38Llama 4 ScoutMeta AIimage-text-to-text
業界最大の10Mトークンコンテキストウィンドウを持つオープンウェイトMoEモデル。16エキスパート構成、単一H100 GPUで動作。
GENERALmultimodalScore—Price—Context10.0M - 39Claude 3.5 SonnetAnthropicimage-text-to-text
Anthropicの最も高性能なモデル。コーディング、分析、クリエイティブタスクで卓越。コンピュータ使用機能を搭載。
GENERALllmScore—Price—Context200K - 40Gemini 1.5 ProGoogle DeepMindvideo-text-to-text
Googleのミッドサイズマルチモーダルモデル。200万トークンの超大規模コンテキストウィンドウを持つ。
GENERALmultimodalScore—Price—Context2.0M
次に進む
目的に合わせて、学ぶ・比較する・相談するの3つの導線から選べます。