Compara modelos para tu carga, no con un ranking único.
Define el tamaño de una solicitud y filtra por inteligencia medida, latencia, contexto o coste. El explorador mantiene separada la procedencia del precio API de las mediciones independientes de Artificial Analysis para que puedas ver el compromiso entre calidad, velocidad y gasto. Se priorizan tarifas USD publicadas por el proveedor; si no existe una tabla USD pública, la fila indica el uso de la tarifa observada por Artificial Analysis sobre la API first-party.
Cargando datos…
Frontera precio/inteligencia: un modelo entra cuando ningún otro consigue a la vez un índice igual o mayor y un coste igual o menor para la solicitud definida.
La misma comparación, sin ocultar dimensiones.
Las variantes de razonamiento se comparan como configuraciones distintas. Un índice alto no implica que el modelo sea mejor para todas las tareas.
| Modelo | Coste | Índice | tokens/s | TTFT | Contexto | Lectura |
|---|
Qué significan las cifras.
Coste. El explorador aplica el precio estándar público del proveedor a los tokens que defines. En GPT-5.6 también aplica el multiplicador publicado cuando la entrada supera 272k tokens. No incluye caché, herramientas, búsquedas, descuentos, batch ni tiers premium.
Intelligence Index. Es el índice compuesto de Artificial Analysis para la configuración indicada. Resume varias evaluaciones de razonamiento, conocimiento, código y trabajo con herramientas. Es una señal útil para comparar, no una medida universal de «inteligencia» ni un sustituto de tus evals.
Velocidad y TTFT. Artificial Analysis los mide contra APIs reales. tokens/s describe la velocidad una vez iniciada la salida; TTFT mide el tiempo hasta el primer token. En modelos razonadores, la latencia puede estar dominada por el tiempo de deliberación y cambiar mucho con el esfuerzo elegido.
Frontera. No se calcula una puntuación secreta ni se asignan pesos arbitrarios. La frontera de Pareto solo identifica configuraciones que no están dominadas simultáneamente en coste e Intelligence Index.
Datos verificados el 26 de septiembre de 2026 contra Artificial Analysis Intelligence Index v4.3.2. El registro de releases revisa todas las entradas nuevas desde el snapshot anterior; el gráfico contiene 15 configuraciones actuales con procedencia completa de precio, contexto, Intelligence Index, velocidad y TTFT. Las releases revisadas que todavía no cumplen ese contrato quedan registradas en el dataset con un motivo explícito de exclusión. Las superficies que Artificial Analysis marca como obsoletas o históricas se retiran del conjunto actual: este audit elimina Gemini 3.6 Flash y registra también Gemini 3.7 Flash como parte de la cadena de supersesión hacia Gemini 3.8 Flash.