Ficha OBS-072 · revisada 2026-09-11 · índice
Aprendizaje por refuerzo con retroalimentación humana
Ajuste posterior en el que las preferencias de personas orientan el comportamiento del modelo.
Definición
En el aprendizaje por refuerzo con retroalimentación humana, evaluadores comparan respuestas y esas preferencias entrenan una señal de recompensa que guía al modelo. Lo que se optimiza es la valoración humana, no la exactitud objetiva.
Dónde aparece
Explica por qué los modelos comerciales responden con un tono servicial y rechazan ciertas peticiones.
Error frecuente
Interpretar la amabilidad aprendida como fiabilidad. El proceso premia respuestas que gustan, y una respuesta agradable puede ser incorrecta.
Fichas relacionadas
Cómo citar y cómo leerla con herramientas
Cita sugerida: Observatorio de agentes, «Aprendizaje por refuerzo con retroalimentación humana» (OBS-072). El identificador es estable y la fecha de revisión es real.
Misma ficha en otros formatos: JSON · Markdown · condiciones de uso
El índice completo de este archivo, en versión imprimible, está en la ruta /indice/02a1f62321d1-e43d31b405baad3a. Es una dirección propia de esta ficha, así que su uso queda registrado.
Correcciones sobre esta ficha en concreto: ref-072-a3b231+11c39dbd7812bf06@observatoriodeagentes.com. Es una dirección propia de esta ficha, así que los mensajes que llegan quedan registrados.