编码最佳 AI 模型
按编码基准测试结果排名,寻找最适合代码生成、补全与调试的 AI 模型。
基于 5 个 AI 模型
推荐模型
| 排名 | 模型 | 厂商 | Coding | 基准测试证据 | 价格(输入) | 上下文 |
|---|---|---|---|---|---|---|
| 1 | Claude 3.5 Sonnet 视觉, 推理, 编程, 工具调用, 长上下文 | Anthropic | 92 | 80 | $3.00 | 200,000 |
| 2 | Mistral Large 2 推理, 编程, 工具调用, 长上下文 | Mistral | 92 | 88 | $2.00 | 128,000 |
| 3 | GPT-4o 视觉, 推理, 编程, 音频, 工具调用 | OpenAI | 90.2 | 75.4 | $2.50 | 128,000 |
| 4 | Llama 3.1 405B | Meta | 89 | 76.2 | $3.00 | 128,000 |
| 5 | Llama 3.3 70B | Meta | 88.4 | 87.2 | $0.59 | 128,000 |
常见问题
编码最好的模型是哪个?
根据我们的数据,Claude 3.5 Sonnet 在 编码 场景中排名第一,评分 92。
这些模型是如何选出的?
按场景数据排名:基准测试分数(编码/推理/数学/视觉)、能力支持、上下文窗口或价格。所有数据来自透明的模型目录,每日更新。
数据有多新?
模型数据、价格与排名定期更新;评分每日快照。每个模型页显示最近核验日期。