Explicación detallada
Ejemplos
Preguntas frecuentes
¿Qué es el RLHF?
Reinforcement Learning from Human Feedback: se entrena el modelo para preferir las respuestas consideradas mejores por humanos.
Términos relacionados
Machine Learning
Rama de la IA en la que los modelos aprenden patrones a partir de datos en lugar de seguir reglas explícitas.
Aprendizaje supervisado
Aprendizaje a partir de ejemplos etiquetados (entrada → salida esperada).
Aprendizaje profundo
Subcampo del aprendizaje automático que utiliza redes neuronales profundas para aprender representaciones complejas.
Aprendizaje no supervisado
Aprendizaje a partir de datos sin labels, donde el modelo descubre por sí mismo estructuras.
Última actualización: 15/7/2026