Experimenta con las variables de un sistema de IA.
Calculadoras, visualizadores y laboratorios para responder preguntas de ingeniería de IA con supuestos visibles. Cada herramienta explica el método, documenta las fuentes y permite reproducir el escenario.
Herramientas disponibles
Una herramienta aparece aquí cuando las versiones española e inglesa comparten la misma lógica, fuentes y pruebas.
Coste y latencia de LLMs
Convierte tokens, caché, tráfico, TTFT, velocidad de generación y concurrencia en coste por solicitud, coste mensual, tiempo de respuesta y capacidad aproximada.
Abrir calculadora →Precio y rendimiento de modelos
Compara el coste de tu carga con Intelligence Index, velocidad, TTFT y contexto, manteniendo separadas las fuentes de precio y rendimiento.
Abrir explorador →VRAM para inferencia
Separa pesos, KV cache y reserva de runtime para estimar memoria total, memoria por GPU, contexto máximo y concurrencia aproximada.
Abrir calculadora →KV cache y ventana de contexto
Visualiza cómo cambian la memoria de KV cache y la capacidad de contexto con GQA/MQA, precisión, concurrencia y presupuesto de memoria.
Abrir explorador →Atención Transformer
Manipula scores, máscara causal, softmax y valores para ver cómo una cabeza de atención convierte una consulta en una mezcla ponderada.
Abrir visualizador →Presupuesto de tokens y contexto
Reparte la ventana entre instrucciones, tools, historial, RAG, mensaje actual, salida y margen para detectar overflow y presión futura.
Abrir planificador →Recuperación RAG
Mide Precision@k, Recall@k, MRR y nDCG sobre un ranking visible; prueba reranking y separa calidad de recuperación de la huella de chunking y solape.
Abrir laboratorio →Lo siguiente
La sección crece una herramienta cada vez. No se publican páginas vacías: cada entrada aparece cuando tiene interacción real, paridad ES/EN, fuentes y pruebas.