Temas¶
Todas las series y presentaciones organizadas por tema.
AGI¶
Agentes¶
- Agente Reactivo, Proactivo y Tool calls
- Agentes reactivos y proactivos en voz
- Anatomía de un agente
- Arquitecturas de memoria: working, episodic, semantic y estado persistente
- Arquitecturas de voz
- Context budgets, priorización, compaction y provenance
- Context engineering vs prompt engineering
- Contexto, workspace y aislamiento
- Controles de producción
- Cómo evaluar un agente
- De la demo a producción
- Envenenamiento
- Evaluación de trayectorias de agentes y tools: éxito, eficiencia, recuperación y cumplimiento de política
- MCP: hosts, clients, servers, tools, resources, prompts, ciclo de vida y fronteras de confianza
- Presentación
- Prompt injection
- Qué es un agent harness
- Qué es un agente
- Qué evaluar: modelo, componente, sistema, workflow y trayectoria
- Retrieval y ensamblado de contexto
- Seguridad de agentes
- Skills, plugins, subagentes y hooks
- Specs, planificación y checkpoints
- Tareas largas, memoria y subagentes
- Tests, verifiers y evaluación de tareas
- Tools, estado y acciones asíncronas
- Tools, permisos y trust boundaries
- Turn-taking
Alineamiento¶
Arquitectura¶
- Agente Reactivo, Proactivo y Tool calls
- Agentes reactivos y proactivos en voz
- Anatomía de un agente
- Arquitecturas de memoria: working, episodic, semantic y estado persistente
- Arquitecturas de voz
- Context budgets, priorización, compaction y provenance
- Context engineering vs prompt engineering
- Contexto, workspace y aislamiento
- De la demo a producción
- Presentación
- Qué es un agent harness
- Tres arquitecturas para agentes de voz
Benchmarking¶
Bienestar¶
Coding agents¶
- Contexto, workspace y aislamiento
- Qué es un agent harness
- Specs, planificación y checkpoints
- Tareas largas, memoria y subagentes
- Tests, verifiers y evaluación de tareas
- Tools, permisos y trust boundaries
Context engineering¶
- Arquitecturas de memoria: working, episodic, semantic y estado persistente
- Context budgets, priorización, compaction y provenance
- Context engineering vs prompt engineering
- MCP: hosts, clients, servers, tools, resources, prompts, ciclo de vida y fronteras de confianza
- Retrieval y ensamblado de contexto
- Skills, plugins, subagentes y hooks
Datasets¶
Economía¶
Energía¶
- Electricidad y bienestar
- Energía, calor y conectividad
- IA como tecnología eléctrica
- Por qué ahora
- Presentación
- Presentación
Espacio¶
Evaluación¶
- Cómo evaluar un agente
- Evaluación
- Evaluación de trayectorias de agentes y tools: éxito, eficiencia, recuperación y cumplimiento de política
- Evaluación online: shadow, canary, A/B, guardrails y regression gates
- Evaluación, observabilidad y reliability
- LLM-as-judge y evaluación humana: calibración, sesgo, varianza y acuerdo
- Observabilidad, taxonomías de fallos y feedback loops producción → eval → reparación
- Offline eval sets: curación, hard negatives, contaminación y versionado
- Qué evaluar: modelo, componente, sistema, workflow y trayectoria
- Red-teaming
- Skills, plugins, subagentes y hooks
- Specs, planificación y checkpoints
- Tests, verifiers y evaluación de tareas
Experimentos¶
GPUs¶
GenAI¶
- Alineamiento
- Arquitecturas
- El problema
- IA vs IA Generativa
- Presentación
- Presentación
- Riesgos
- ¿Qué es IA Generativa?
- ¿Qué es la IA?
Historia¶
IA¶
- AGI
- Agente Reactivo, Proactivo y Tool calls
- Agentes reactivos y proactivos en voz
- Alineamiento
- Anatomía de un agente
- Aprender
- Arquitecturas
- Arquitecturas de memoria: working, episodic, semantic y estado persistente
- Arquitecturas de voz
- Benchmarking de inferencia: cost/task, throughput, latencia, energía y hardware
- Context budgets, priorización, compaction y provenance
- Context engineering vs prompt engineering
- Contexto, workspace y aislamiento
- Controles de producción
- Cuantización, paralelismo y compromisos de memoria, rendimiento y calidad
- Cómo evaluar un agente
- De la demo a producción
- El problema
- Electricidad y bienestar
- Energía, calor y conectividad
- Envenenamiento
- Escalar
- Evaluación
- Evaluación de trayectorias de agentes y tools: éxito, eficiencia, recuperación y cumplimiento de política
- Evaluación online: shadow, canary, A/B, guardrails y regression gates
- Evaluación, observabilidad y reliability
- Fallos de los modelos razonadores
- IA como tecnología eléctrica
- IA vs IA Generativa
- IA y PIB hoy
- Jailbreaks
- KV cache, jerarquía de memoria, continuous batching y PagedAttention
- LLM-as-judge y evaluación humana: calibración, sesgo, varianza y acuerdo
- La huella real de un datacenter
- MCP: hosts, clients, servers, tools, resources, prompts, ciclo de vida y fronteras de confianza
- Mecanizar
- Medición — PIB vs bienestar
- Model routing, fallback, caching y serving adaptado al workload
- Más allá del Transformer
- Observabilidad, taxonomías de fallos y feedback loops producción → eval → reparación
- Offline eval sets: curación, hard negatives, contaminación y versionado
- Por qué ahora
- Prefill vs decode
- Presentación
- Presentación
- Presentación
- Presentación
- Presentación
- Presentación
- Presentación
- Presentación
- Presupuesto de latencia
- Prompt injection
- Qué es razonar
- Qué es un agent harness
- Qué es un agente
- Qué es un datacenter espacial
- Qué evaluar: modelo, componente, sistema, workflow y trayectoria
- Red-teaming
- Representar
- Retrieval y ensamblado de contexto
- Riesgos
- Riesgos
- Seguridad de agentes
- Skills, plugins, subagentes y hooks
- Specs, planificación y checkpoints
- Speculative decoding, prefix caching y otras optimizaciones de latencia
- Tareas largas, memoria y subagentes
- Test-Time Compute
- Tests, verifiers y evaluación de tareas
- Tiempo, latencia, streaming e interacción humana
- Tools, estado y acciones asíncronas
- Tools, permisos y trust boundaries
- Tres arquitecturas para agentes de voz
- Turn-taking
- WebRTC, SIP y telefonía
- ¿Qué es IA Generativa?
- ¿Qué es la IA?
Inferencia¶
- Benchmarking de inferencia: cost/task, throughput, latencia, energía y hardware
- Cuantización, paralelismo y compromisos de memoria, rendimiento y calidad
- KV cache, jerarquía de memoria, continuous batching y PagedAttention
- Model routing, fallback, caching y serving adaptado al workload
- Más allá del Transformer
- Prefill vs decode
- Speculative decoding, prefix caching y otras optimizaciones de latencia
Infraestructura¶
- Energía, calor y conectividad
- La huella real de un datacenter
- Por qué ahora
- Presentación
- Qué es un datacenter espacial
LLMs¶
- Aprender
- Benchmarking de inferencia: cost/task, throughput, latencia, energía y hardware
- Context budgets, priorización, compaction y provenance
- Context engineering vs prompt engineering
- Cuantización, paralelismo y compromisos de memoria, rendimiento y calidad
- Envenenamiento
- Escalar
- Fallos de los modelos razonadores
- IA vs IA Generativa
- Jailbreaks
- KV cache, jerarquía de memoria, continuous batching y PagedAttention
- Model routing, fallback, caching y serving adaptado al workload
- Más allá del Transformer
- Prefill vs decode
- Presentación
- Presentación
- Presentación
- Presentación
- Presentación
- Prompt injection
- Qué es razonar
- Red-teaming
- Riesgos
- Speculative decoding, prefix caching y otras optimizaciones de latencia
- Test-Time Compute
- Tiempo, latencia, streaming e interacción humana
- ¿Qué es IA Generativa?
- ¿Qué es la IA?
Latencia¶
MCP¶
Medioambiente¶
Memoria¶
- Arquitecturas de memoria: working, episodic, semantic y estado persistente
- KV cache, jerarquía de memoria, continuous batching y PagedAttention
Multimodalidad¶
- Alineamiento
- Arquitecturas
- El problema
- Evaluación
- Presentación
- Riesgos
- Tres arquitecturas para agentes de voz
Observabilidad¶
- Cómo evaluar un agente
- Evaluación, observabilidad y reliability
- Observabilidad, taxonomías de fallos y feedback loops producción → eval → reparación
- Tareas largas, memoria y subagentes
Planificación¶
Producción¶
- Controles de producción
- De la demo a producción
- Evaluación de trayectorias de agentes y tools: éxito, eficiencia, recuperación y cumplimiento de política
- Evaluación online: shadow, canary, A/B, guardrails y regression gates
- Evaluación, observabilidad y reliability
- LLM-as-judge y evaluación humana: calibración, sesgo, varianza y acuerdo
- Observabilidad, taxonomías de fallos y feedback loops producción → eval → reparación
- Offline eval sets: curación, hard negatives, contaminación y versionado
- Presupuesto de latencia
- Qué evaluar: modelo, componente, sistema, workflow y trayectoria
- Tools, estado y acciones asíncronas
- Turn-taking
- WebRTC, SIP y telefonía
Productividad¶
Prompt Injection¶
RAG¶
Razonamiento¶
- Fallos de los modelos razonadores
- Más allá del Transformer
- Presentación
- Qué es razonar
- Riesgos
- Test-Time Compute
- Tiempo, latencia, streaming e interacción humana
Realtime¶
- Arquitecturas de voz
- Evaluación, observabilidad y reliability
- Presupuesto de latencia
- Tools, estado y acciones asíncronas
- Tres arquitecturas para agentes de voz
- Turn-taking
- WebRTC, SIP y telefonía
Reliability¶
- Evaluación de trayectorias de agentes y tools: éxito, eficiencia, recuperación y cumplimiento de política
- Evaluación online: shadow, canary, A/B, guardrails y regression gates
- Evaluación, observabilidad y reliability
- LLM-as-judge y evaluación humana: calibración, sesgo, varianza y acuerdo
- Observabilidad, taxonomías de fallos y feedback loops producción → eval → reparación
- Offline eval sets: curación, hard negatives, contaminación y versionado
- Qué evaluar: modelo, componente, sistema, workflow y trayectoria
Rendimiento¶
Retrieval¶
Routing¶
Runtime¶
Seguridad¶
- Contexto, workspace y aislamiento
- Controles de producción
- Envenenamiento
- Jailbreaks
- MCP: hosts, clients, servers, tools, resources, prompts, ciclo de vida y fronteras de confianza
- Presentación
- Prompt injection
- Red-teaming
- Seguridad de agentes
- Skills, plugins, subagentes y hooks
- Tools, permisos y trust boundaries
Serving¶
- Benchmarking de inferencia: cost/task, throughput, latencia, energía y hardware
- Cuantización, paralelismo y compromisos de memoria, rendimiento y calidad
- KV cache, jerarquía de memoria, continuous batching y PagedAttention
- Model routing, fallback, caching y serving adaptado al workload
- Prefill vs decode
- Speculative decoding, prefix caching y otras optimizaciones de latencia
Software¶
- Contexto, workspace y aislamiento
- Qué es un agent harness
- Specs, planificación y checkpoints
- Tareas largas, memoria y subagentes
- Tests, verifiers y evaluación de tareas
- Tools, permisos y trust boundaries
Telefonía¶
Tool Calling¶
- Agente Reactivo, Proactivo y Tool calls
- Agentes reactivos y proactivos en voz
- Anatomía de un agente
- Presentación
- Qué es un agente
- Tres arquitecturas para agentes de voz
Voz¶
- Agentes reactivos y proactivos en voz
- Arquitecturas de voz
- Evaluación, observabilidad y reliability
- Presupuesto de latencia
- Tools, estado y acciones asíncronas
- Tres arquitecturas para agentes de voz
- Turn-taking
- WebRTC, SIP y telefonía