Cuti Talk Innovación: ¿Cómo se prueba algo que no siempre responde igual?

Los sistemas basados en IA rompen muchos de los supuestos sobre los que se construyó el testing tradicional.El mismo input puede generar outputs distintos, no existe una «respuesta correcta» única y los modelos alucinan o derivan con el tiempo. Además, un cambio mínimo en el prompt o en el modelo puede romper un comportamiento que antes funcionaba, sin que ningún test unitario lo detecte. Esto plantea preguntas fundamentales: ¿qué significa que un sistema de IA funcione correctamente?, ¿cómo se mide su calidad?, ¿qué aspectos deberían evaluarse y cómo automatizar esas evaluaciones?.
En esta charla el equipo de QAlified compartirá los principales desafíos que han encontrado al testear sistemas basados en IA generativa, los enfoques que utilizaron para abordarlos y los aprendizajes obtenidos trabajando en la validación de agentes conversacionales y en el desarrollo de ArtificialQA, una plataforma creada para testear, evaluar y monitorear aplicaciones impulsadas por IA.
Exploraremos conceptos como evaluación automática, definición de criterios de calidad, uso de jueces inteligentes y monitoreo continuo, con una mirada práctica orientada a quienes están construyendo o evaluando productos impulsados por IA.
🗓️ Miércoles 15 de julio | 9:30 h. |Híbrido (presencial en Cuti)
Actividad con cupos limitados exclusiva para socios de Cuti.
Solicitamos inscribirse con compromiso de asistencia, ya que cada lugar reservado impide que otra persona interesada pueda participar.
Registro
Conecta