HE-0057 minCurso · Inteligencia artificial
Evaluadores humanos y automáticos
Código cuando se puede, un modelo juez cuando hace falta y personas para calibrar a los dos. Cada evaluador mide algo distinto y se equivoca de forma distinta.
Qué aprenderás
- Elegir para cada criterio el evaluador más barato que lo mida de forma fiable
- Diseñar un modelo juez con un criterio por llamada y veredicto binario
- Calibrar un juez contra etiquetas humanas midiendo sus dos tipos de error por separado
- Organizar una revisión humana que produzca etiquetas consistentes
Suscríbete para seguir
Esta lección es para suscriptores.
Crea tu cuenta y suscríbete para leer «Harness y evaluación» entero, con los recursos y tu progreso guardado.
Suscripción mensual o anual
