← AIモデルランキング
最高の数学AIモデル
ベンチマーク結果・機能・価格・コンテキストに基づく透明で説明可能なモデルスコア。
| 順位 | モデル | プロバイダー | スコア |
|---|---|---|---|
| 1 | Claude 3.5 Sonnet | Anthropic | 88.7 |
| 2 | GPT-4o | OpenAI | 88.7 |
| 3 | Llama 3.1 405B | Meta | 88.6 |
| 4 | DeepSeek V3 | DeepSeek | 88.5 |
| 5 | Claude 3 Opus | Anthropic | 86.8 |
| 6 | Qwen2.5 72B | Alibaba | 86.1 |
| 7 | Llama 3.3 70B | Meta | 86 |
| 8 | Mistral Large 2 | Mistral | 84 |
| 9 | GPT-4o mini | OpenAI | 82 |
| 10 | Gemini 1.5 Pro | 81.9 | |
| 11 | GLM-4 | Zhipu | 81.5 |
| 12 | DeepSeek R1 | DeepSeek | 79.8 |
| 13 | Gemini 1.5 Flash | 78.9 | |
| 14 | Claude 3 Haiku | Anthropic | 75.1 |