数学最佳 AI 模型
数学与量化任务表现最好的模型,按数学基准分数排名。
基于 5 个 AI 模型
推荐模型
| 排名 | 模型 | 厂商 | Math | 基准测试证据 | 价格(输入) | 上下文 |
|---|---|---|---|---|---|---|
| 1 | Claude 3.5 Sonnet 视觉, 推理, 编程, 工具调用, 长上下文 | Anthropic | 88.7 | 80 | $3.00 | 200,000 |
| 2 | GPT-4o 视觉, 推理, 编程, 音频, 工具调用 | OpenAI | 88.7 | 75.4 | $2.50 | 128,000 |
| 3 | Llama 3.1 405B | Meta | 88.6 | 76.2 | $3.00 | 128,000 |
| 4 | DeepSeek V3 | DeepSeek | 88.5 | 85.6 | $0.27 | 65,536 |
| 5 | Claude 3 Opus | Anthropic | 86.8 | 74 | $15.00 | 200,000 |
常见问题
数学最好的模型是哪个?
根据我们的数据,Claude 3.5 Sonnet 在 数学 场景中排名第一,评分 89。
这些模型是如何选出的?
按场景数据排名:基准测试分数(编码/推理/数学/视觉)、能力支持、上下文窗口或价格。所有数据来自透明的模型目录,每日更新。
数据有多新?
模型数据、价格与排名定期更新;评分每日快照。每个模型页显示最近核验日期。