Los mejores modelos de IA para programar
Ordenados por SWE-bench Verified: el porcentaje de errores reales de proyectos de código abierto reales que cada modelo corrige por sí solo. Evaluado de forma independiente por Epoch AI, junto a los precios actuales de las API.
Nuestra selección
El ranking
Comparar los dos primeros| # | Modelo | SWE-bench Verifiedi | Índice generali | Entradai | Salidai | Contextoi |
|---|---|---|---|---|---|---|
| 1 | Claude Opus 4.7Anthropic | 83.5% | 156.4 | 5 US$ | 25 US$ | 1M |
| 2 | Gemini 3.5 FlashGoogle DeepMind | 79.3% | 154.6 | 1,50 US$ | 9 US$ | 1M |
| 3 | GLM 5.2Z.ai (Zhipu) | 78.7% | 151.8 | 0,14 US$ | 3,99 US$ | 1M |
| 4 | Claude Opus 4.6Anthropic | 78.7% | 155.4 | 5 US$ | 25 US$ | 1M |
| 5 | DeepSeek V4 Pro 0813DeepSeek | 77.6% | 155.4 | 0,66 US$ | 1,98 US$ | 1M |
| 6 | Qwen3.7 MaxAlibaba Qwen | 77.3% | 153.7 | 1,48 US$ | 4,43 US$ | 1M |
| 7 | GPT-5.4OpenAI | 76.9% | 156.9 | 2,50 US$ | 15 US$ | 1.1M |
| 8 | Qwen3.6 Max PreviewAlibaba Qwen | 76.7% | 149.3 | 1,03 US$ | 6,16 US$ | 256K |
| 9 | Kimi K2.6Moonshot AI | 76.7% | 151.0 | 0,65 US$ | 3,41 US$ | 256K |
| 10 | Claude Opus 4.5Anthropic | 76.7% | 150.1 | 5 US$ | 25 US$ | 200K |
por millón de tokens · USD
Respuestas rápidas
- ¿Cuál es el mejor modelo de IA para programar?
- Claude Opus 4.7, de Anthropic, encabeza este ranking (SWE-bench Verified: 83.5%). Cuesta 5 US$ por millón de tokens de entrada y 25 US$ por millón de tokens de salida.
- ¿Hay una alternativa más barata?
- DeepSeek V4 Pro 0813, de DeepSeek (SWE-bench Verified: 77.6%), cuesta 0,66 US$ / 1,98 US$ por millón de tokens, unas 10 veces menos que Claude Opus 4.7.
Cómo ordenamos
Las puntuaciones provienen de pruebas realizadas de forma independiente por Epoch AI (CC BY 4.0), no de los anuncios de las propias empresas. Los precios provienen de la API pública de OpenRouter. Ambos se actualizan automáticamente varias veces al día, así que este ranking sigue los nuevos lanzamientos y los cambios de precio.
Otros rankings
MatemáticasCienciasBaratosGratisCódigo abiertoContexto largoImágenes y PDFRankings →