Zolamir está hecho para poder comprobarse. Cada cifra del sitio proviene de una fuente pública que citamos, se actualiza automáticamente y se muestra junto con el método que hay detrás. Esta página explica cómo.
De dónde vienen los datos
- Modelos y precios: la API pública de OpenRouter, que recoge los modelos que ofrecen decenas de proveedores con sus precios por millón de tokens, su ventana de contexto y sus capacidades. Los precios y la disponibilidad por proveedor provienen de la misma API.
- Puntuaciones de calidad: los resultados de pruebas independientes que publica Epoch AI con licencia CC BY 4.0: el Epoch Capabilities Index, SWE-bench Verified, GPQA Diamond, AIME, FrontierMath y SimpleQA Verified. No usamos las puntuaciones que anuncian las propias empresas.
- Noticias: las fuentes RSS públicas de los laboratorios de IA y de la prensa tecnológica en cuatro idiomas, además de las noticias de IA más comentadas en Hacker News. Solo mostramos el titular, un breve extracto y un enlace: el artículo siempre permanece en el sitio del medio.
- Investigación: los artículos destacados por la comunidad de Hugging Face y los modelos abiertos en tendencia en Hugging Face.
Cada cuánto se actualiza
Un proceso automático se ejecuta cada cuatro horas. Descarga los datos nuevos, registra los nuevos modelos y los cambios de precio en el registro de cambios, traduce los titulares nuevos y reconstruye el sitio. Las puntuaciones de calidad se actualizan cada día y nuestras mediciones de tokens cada mes. Cada semana se resume en Esta semana en IA.
Cómo funcionan los rankings
Los rankings ordenan los modelos según una prueba independiente cada vez. Cuando un modelo se probó con varias configuraciones, conservamos su mejor resultado. Los modelos nuevos aparecen cuando ya se han evaluado, normalmente pocas semanas después de su lanzamiento. Las páginas «los mejores para» combinan estas puntuaciones con los precios actuales según reglas sencillas y explícitas (por ejemplo, «capaz» significa un índice general de 140 o más).
Cómo medimos el costo de cada idioma
Escribimos los mismos cuatro textos en 15 idiomas y contamos los tokens que produce el tokenizador público de cada empresa. La proporción respecto al inglés da el costo extra de cada idioma para cada familia de modelos. Las empresas que no publican su tokenizador reciben el promedio de las familias medidas, marcado con ≈.
Traducciones
Los titulares y resúmenes publicados en otros idiomas se traducen automáticamente con modelos de código abierto (Opus-MT y NLLB) que ejecutamos nosotros mismos. Siempre llevan la indicación «Traducido del…» y enlazan al artículo original. Los textos de la interfaz, las guías y las explicaciones los escribimos nosotros en cada idioma.
Límites y correcciones
Los datos automáticos pueden ser erróneos o estar desactualizados: un proveedor puede cambiar un precio antes de nuestra siguiente actualización, y cualquier prueba favorece a cierto tipo de modelos. Consulta siempre la página oficial del proveedor antes de una decisión de compra. Si encuentras un error, avísanos y lo corregiremos.