Tema

Evaluación, observabilidad y calidad

Mide el comportamiento de la IA, detecta regresiones, controla costes y latencia y mejora continuamente los flujos de trabajo.

12 contenidos (5 artículos · 7 vídeos)

Comienza aquí

Una selección inicial antes de explorar todo el contenido.

Más sobre este tema

Vídeo

El panorama de los agentes: lecciones aprendidas al llevar agentes a producción

El panorama de los agentes: lecciones aprendidas al llevar agentes a producción

Avanzado
10 min de lectura
Artículo

Modos de fallo de IA en producción: qué falla después de la demostración

Los sistemas de IA suelen fallar de formas predecibles: alucinaciones, contexto obsoleto, complacencia, inyección de prompts, uso inseguro de herramientas, deriva de esquemas y gestión deficiente de fallos. Este registro de modos de fallo está dirigido a equipos que despliegan flujos de trabajo reales.

Avanzado
11 min de lectura
Artículo

Fragmentación, reranking y búsqueda híbrida: consigue que RAG funcione de verdad

La mayoría de las implementaciones de RAG funcionan mal porque fallan en tres aspectos. Una guía práctica para fragmentar documentos, reordenar resultados y combinar la búsqueda por palabras clave con la semántica, sin convertirte en especialista en motores de búsqueda.

Intermedio
Vídeo

Por qué las evaluaciones de IA son la nueva habilidad más demandada para quienes crean productos | Hamel Husain y Shreya Shankar

Por qué las evaluaciones de IA son la nueva habilidad más demandada para quienes crean productos | Hamel Husain y Shreya Shankar

Intermedio
Vídeo

Evalúa prompts en la consola de Anthropic

Evalúa prompts en la consola de Anthropic

Intermedio
Vídeo

Cómo configurar sistemáticamente evaluaciones de modelos de lenguaje (métricas, pruebas unitarias, modelo como juez)

Cómo configurar sistemáticamente evaluaciones de modelos de lenguaje (métricas, pruebas unitarias, modelo como juez)

Avanzado
Vídeo

Cómo construir sistemas de evaluación específicos de dominio para modelos de lenguaje: Hamel Husain y Emil Sedgh

Cómo construir sistemas de evaluación específicos de dominio para modelos de lenguaje: Hamel Husain y Emil Sedgh

Avanzado
Vídeo

LangSmith en 10 minutos

LangSmith en 10 minutos

Avanzado
Vídeo

Instrumentación y evaluación de LLM

Instrumentación y evaluación de LLM

Avanzado