Herramientas · Modelos · 02

Compara modelos para tu carga, no con un ranking único.

Define el tamaño de una solicitud y filtra por inteligencia medida, latencia, contexto o coste. El explorador mantiene separada la procedencia del precio API de las mediciones independientes de Artificial Analysis para que puedas ver el compromiso entre calidad, velocidad y gasto. Se priorizan tarifas USD publicadas por el proveedor; si no existe una tabla USD pública, la fila indica el uso de la tarifa observada por Artificial Analysis sobre la API first-party.

CalidadIntelligence Index
Rendimientotokens/s + TTFT
PrecioAPI first-party con fuente

Carga de trabajo

El coste mostrado usa estas cantidades y las tarifas estándar vigentes. Si el proveedor aplica una regla publicada de contexto largo, se incorpora automáticamente.

Filtros

0 = sin límite.
0 = sin límite.
0 = sin límite.

Vista

Visibles—
En frontera—

Cargando datos…

Mayor índice—
Menor coste—
Mayor velocidad—
Menor TTFT—
Mapa comparativoselecciona un punto para ver su procedencia
Intelligence Index

Coste por solicitud

Frontera precio/inteligencia: un modelo entra cuando ningún otro consigue a la vez un índice igual o mayor y un coste igual o menor para la solicitud definida.

Datos comparables

La misma comparación, sin ocultar dimensiones.

Las variantes de razonamiento se comparan como configuraciones distintas. Un índice alto no implica que el modelo sea mejor para todas las tareas.

ModeloCosteÍndicetokens/sTTFTContextoLectura
Método

Qué significan las cifras.

Coste. El explorador aplica el precio estándar público del proveedor a los tokens que defines. En GPT-5.6 también aplica el multiplicador publicado cuando la entrada supera 272k tokens. No incluye caché, herramientas, búsquedas, descuentos, batch ni tiers premium.

coste_solicitud = Tentrada × Pentrada / 10⁶ + Tsalida × Psalida / 10⁶

Intelligence Index. Es el índice compuesto de Artificial Analysis para la configuración indicada. Resume varias evaluaciones de razonamiento, conocimiento, código y trabajo con herramientas. Es una señal útil para comparar, no una medida universal de «inteligencia» ni un sustituto de tus evals.

Velocidad y TTFT. Artificial Analysis los mide contra APIs reales. tokens/s describe la velocidad una vez iniciada la salida; TTFT mide el tiempo hasta el primer token. En modelos razonadores, la latencia puede estar dominada por el tiempo de deliberación y cambiar mucho con el esfuerzo elegido.

Frontera. No se calcula una puntuación secreta ni se asignan pesos arbitrarios. La frontera de Pareto solo identifica configuraciones que no están dominadas simultáneamente en coste e Intelligence Index.

Datos verificados el 26 de septiembre de 2026 contra Artificial Analysis Intelligence Index v4.3.2. El registro de releases revisa todas las entradas nuevas desde el snapshot anterior; el gráfico contiene 15 configuraciones actuales con procedencia completa de precio, contexto, Intelligence Index, velocidad y TTFT. Las releases revisadas que todavía no cumplen ese contrato quedan registradas en el dataset con un motivo explícito de exclusión. Las superficies que Artificial Analysis marca como obsoletas o históricas se retiran del conjunto actual: este audit elimina Gemini 3.6 Flash y registra también Gemini 3.7 Flash como parte de la cadena de supersesión hacia Gemini 3.8 Flash.

Fuentes y fecha de verificación