推理最佳 AI 模型
逻辑推理与复杂问题求解能力强的模型,按推理基准排名。
基于 5 个 AI 模型
推荐模型
| 排名 | 模型 | 厂商 | Reasoning | 基准测试证据 | 价格(输入) | 上下文 |
|---|---|---|---|---|---|---|
| 1 | DeepSeek R1 | DeepSeek | 71.5 | 75.7 | $0.55 | 65,536 |
| 2 | Claude 3.5 Sonnet 视觉, 推理, 编程, 工具调用, 长上下文 | Anthropic | 59.4 | 80 | $3.00 | 200,000 |
| 3 | GPT-4o 视觉, 推理, 编程, 音频, 工具调用 | OpenAI | 53.6 | 75.4 | $2.50 | 128,000 |
| 4 | Llama 3.1 405B | Meta | 51.1 | 76.2 | $3.00 | 128,000 |
| 5 | Claude 3 Opus | Anthropic | 50.4 | 74 | $15.00 | 200,000 |
常见问题
推理最好的模型是哪个?
根据我们的数据,DeepSeek R1 在 推理 场景中排名第一,评分 72。
这些模型是如何选出的?
按场景数据排名:基准测试分数(编码/推理/数学/视觉)、能力支持、上下文窗口或价格。所有数据来自透明的模型目录,每日更新。
数据有多新?
模型数据、价格与排名定期更新;评分每日快照。每个模型页显示最近核验日期。