Saltar al contenido

HE-0057 minCurso · Inteligencia artificial

Evaluadores humanos y automáticos

Código cuando se puede, un modelo juez cuando hace falta y personas para calibrar a los dos. Cada evaluador mide algo distinto y se equivoca de forma distinta.

Qué aprenderás

  1. Elegir para cada criterio el evaluador más barato que lo mida de forma fiable
  2. Diseñar un modelo juez con un criterio por llamada y veredicto binario
  3. Calibrar un juez contra etiquetas humanas midiendo sus dos tipos de error por separado
  4. Organizar una revisión humana que produzca etiquetas consistentes

Suscríbete para seguir

Esta lección es para suscriptores.

Crea tu cuenta y suscríbete para leer «Harness y evaluación» entero, con los recursos y tu progreso guardado.

Suscripción mensual o anual