Experimenta con las variables de un sistema de IA.
18 calculadoras, visualizadores, evaluadores y exploradores para responder preguntas técnicas con supuestos visibles. Cada herramienta documenta el método, conserva las fuentes y permite reproducir el escenario.
Herramientas disponibles
Una herramienta aparece aquí cuando las versiones española e inglesa comparten lógica, fuentes y pruebas.
Coste y latencia de LLMs
Convierte tokens, caché, tráfico, TTFT, velocidad de generación y concurrencia en coste por solicitud, coste mensual, tiempo de respuesta y capacidad aproximada.
Abrir calculadora →Precio y rendimiento de modelos
Compara el coste de tu carga con Intelligence Index, velocidad, TTFT y contexto, manteniendo separadas las fuentes de precio y rendimiento.
Abrir explorador →VRAM para inferencia
Separa pesos, KV cache y reserva de runtime para estimar memoria total, memoria por GPU, contexto máximo y concurrencia aproximada.
Abrir calculadora →KV cache y ventana de contexto
Visualiza cómo cambian la memoria de KV cache y la capacidad de contexto con GQA/MQA, precisión, concurrencia y presupuesto de memoria.
Abrir explorador →Atención Transformer
Manipula scores, máscara causal, softmax y valores para ver cómo una cabeza de atención convierte una consulta en una mezcla ponderada.
Abrir visualizador →Presupuesto de tokens y contexto
Reparte la ventana entre instrucciones, herramientas, historial, RAG, mensaje actual, salida y margen para detectar overflow y presión futura.
Abrir planificador →Recuperación RAG
Mide Precision@k, Recall@k, MRR y nDCG sobre un ranking visible; prueba reranking y separa calidad de recuperación de la huella de chunking y solape.
Abrir laboratorio →Evaluación RAG
Separa relevancia del contexto, fidelidad, corrección y cobertura; inspecciona afirmaciones, intervalos y pesos sin esconder el diagnóstico en una sola puntuación.
Abrir evaluador →Latencia de agentes de voz
Descompón el tiempo hasta el primer audio entre transporte, fin de turno, STT, modelo, TTS y buffering, y calcula el camino de interrupción por separado.
Abrir explorador →Coste y capacidad de agentes de voz
Convierte llamadas, minutos, STT, TTS y tokens en coste mensual y dimensiona workers y límites de proveedor sin confundir llamadas simultáneas con generaciones simultáneas.
Abrir planificador →Fiabilidad y evaluación de agentes
Separa éxito final, primer intento, recuperación tras reintentos, decisiones de herramientas, timeouts y eficiencia de trayectoria; aplica criterios de publicación explícitos.
Abrir evaluador →Amenazas de prompt injection
Traza rutas desde contenido no confiable hacia datos, herramientas, salida externa y memoria persistente, y comprueba qué límites arquitectónicos cortan cada camino.
Abrir explorador →Fiabilidad de benchmarks
Comprueba resolución estadística, saturación, sensibilidad a ítems inválidos o exposición del test y fragilidad del ranking cuando cambia la composición de tareas.
Abrir explorador →Línea temporal de capacidades
Recorre resultados publicados de un benchmark a la vez, conserva condiciones y procedencia por punto y hace visibles los cambios de protocolo.
Abrir explorador →Leyes de escalado
Redistribuye un presupuesto fijo de entrenamiento entre parámetros y tokens, compara el óptimo de una superficie tipo Chinchilla y comprueba su sensibilidad a los exponentes.
Abrir explorador →Cómputo y energía de entrenamiento
Convierte aceleradores, MFU, duración, potencia media y PUE en FLOPs de modelo, tiempo estimado, potencia de instalación y energía.
Abrir calculadora →Capacidad de IA en datacenters
Contrasta potencia total, PUE, slots, potencia y refrigeración por rack para encontrar cuántos aceleradores pueden estar activos y qué límite físico domina.
Abrir explorador →Ecosistema global de IA
Compara inversión, creación de empresas, infraestructura, modelos, talento y capacidad de política pública con cobertura, normalización y pesos visibles.
Abrir explorador →