Herramientas · Modelos · 02

Compara modelos para tu carga, no con un ranking único.

Define el tamaño de una solicitud y filtra por inteligencia medida, latencia, contexto o coste. El explorador mantiene separados el precio del proveedor y las mediciones independientes de Artificial Analysis para que puedas ver el compromiso entre calidad, velocidad y gasto.

CalidadIntelligence Index
Rendimientotokens/s + TTFT
PrecioAPI oficial vigente

Carga de trabajo

El coste mostrado usa estas cantidades y las tarifas estándar vigentes. Si el proveedor aplica una regla publicada de contexto largo, se incorpora automáticamente.

Filtros

0 = sin límite.
0 = sin límite.
0 = sin límite.

Vista

Visibles
En frontera

Cargando datos…

Mayor índice
Menor coste
Mayor velocidad
Menor TTFT
Mapa comparativoselecciona un punto para ver su procedencia
Intelligence Index

Coste por solicitud

Frontera precio/inteligencia: un modelo entra cuando ningún otro consigue a la vez un índice igual o mayor y un coste igual o menor para la solicitud definida.

Datos comparables

La misma comparación, sin ocultar dimensiones.

Las variantes de razonamiento se comparan como configuraciones distintas. Un índice alto no implica que el modelo sea mejor para todas las tareas.

ModeloCosteÍndicetokens/sTTFTContextoLectura
Método

Qué significan las cifras.

Coste. El explorador aplica el precio estándar público del proveedor a los tokens que defines. En GPT-5.6 también aplica el multiplicador publicado cuando la entrada supera 272k tokens. No incluye caché, herramientas, búsquedas, descuentos, batch ni tiers premium.

coste_solicitud = Tentrada × Pentrada / 10⁶ + Tsalida × Psalida / 10⁶

Intelligence Index. Es el índice compuesto de Artificial Analysis para la configuración indicada. Resume varias evaluaciones de razonamiento, conocimiento, código y trabajo con herramientas. Es una señal útil para comparar, no una medida universal de «inteligencia» ni un sustituto de tus evals.

Velocidad y TTFT. Artificial Analysis los mide contra APIs reales. tokens/s describe la velocidad una vez iniciada la salida; TTFT mide el tiempo hasta el primer token. En modelos razonadores, la latencia puede estar dominada por el tiempo de deliberación y cambiar mucho con el esfuerzo elegido.

Frontera. No se calcula una puntuación secreta ni se asignan pesos arbitrarios. La frontera de Pareto solo identifica configuraciones que no están dominadas simultáneamente en coste e Intelligence Index.

Datos verificados el 21 de agosto de 2026. Las mediciones de rendimiento y los benchmarks cambian; la selección es deliberadamente pequeña y solo incluye configuraciones para las que podemos mantener precio, especificaciones y rendimiento con procedencia explícita.

Fuentes y fecha de verificación