视觉模型
具备视觉(图像理解)能力的模型,按综合评分排名。
基于 10 个 AI 模型
| 模型 | 厂商 | 评分 | 价格(输入) | 上下文 |
|---|---|---|---|---|
| Claude 3.5 Sonnet | Anthropic | 78.4 | $3.00 | 200,000 |
| Gemini 1.5 Pro | 76.9 | $1.25 | 2,000,000 | |
| GPT-4o | OpenAI | 73.1 | $2.50 | 128,000 |
| Gemini 2.0 Flash | 47.5 | $0.10 | 1,048,576 | |
| Gemini 2.5 Flash | 47.5 | $0.30 | 1,048,576 | |
| Gemini 2.5 Pro | 47.5 | $1.25 | 1,048,576 | |
| Gemini 3 Flash | 47.5 | $0.50 | 1,048,576 | |
| Gemini 3.1 Pro | 47.5 | $2.00 | 2,000,000 | |
| Claude 3.7 Sonnet | Anthropic | 44.8 | $3.00 | 200,000 |
| Claude Haiku 4.5 | Anthropic | 44.8 | $1.00 | 200,000 |
常见问题
视觉模型最好的模型是哪个?
根据我们的数据,Claude 3.5 Sonnet 在 视觉模型 场景中排名第一,评分 78。
这些模型是如何选出的?
按场景数据排名:基准测试分数(编码/推理/数学/视觉)、能力支持、上下文窗口或价格。所有数据来自透明的模型目录,每日更新。
数据有多新?
模型数据、价格与排名定期更新;评分每日快照。每个模型页显示最近核验日期。