Los mejores modelos de IA para programar

Ordenados por SWE-bench Verified: el porcentaje de errores reales de proyectos de código abierto reales que cada modelo corrige por sí solo. Evaluado de forma independiente por Epoch AI, junto a los precios actuales de las API.

Actualizado el 30 de septiembre de 2026

Nuestra selección

#ModeloSWE-bench VerifiediÍndice generaliEntradaiSalidaiContextoi
1
83.5%
156.45 US$25 US$1M
2
Gemini 3.5 FlashGoogle DeepMind
79.3%
154.61,50 US$9 US$1M
3
GLM 5.2Z.ai (Zhipu)
78.7%
151.80,14 US$3,99 US$1M
4
78.7%
155.45 US$25 US$1M
5
77.6%
155.40,66 US$1,98 US$1M
6
Qwen3.7 MaxAlibaba Qwen
77.3%
153.71,48 US$4,43 US$1M
7
GPT-5.4OpenAI
76.9%
156.92,50 US$15 US$1.1M
8
76.7%
149.31,03 US$6,16 US$256K
9
Kimi K2.6Moonshot AI
76.7%
151.00,65 US$3,41 US$256K
10
76.7%
150.15 US$25 US$200K

por millón de tokens · USD

Respuestas rápidas

¿Cuál es el mejor modelo de IA para programar?
Claude Opus 4.7, de Anthropic, encabeza este ranking (SWE-bench Verified: 83.5%). Cuesta 5 US$ por millón de tokens de entrada y 25 US$ por millón de tokens de salida.
¿Hay una alternativa más barata?
DeepSeek V4 Pro 0813, de DeepSeek (SWE-bench Verified: 77.6%), cuesta 0,66 US$ / 1,98 US$ por millón de tokens, unas 10 veces menos que Claude Opus 4.7.

Cómo ordenamos

Las puntuaciones provienen de pruebas realizadas de forma independiente por Epoch AI (CC BY 4.0), no de los anuncios de las propias empresas. Los precios provienen de la API pública de OpenRouter. Ambos se actualizan automáticamente varias veces al día, así que este ranking sigue los nuevos lanzamientos y los cambios de precio.

Otros rankings

MatemáticasCienciasBaratosGratisCódigo abiertoContexto largoImágenes y PDFRankings →