Explicación detallada
Ejemplos
Preguntas frecuentes
¿Qué es el RLHF?
Reinforcement Learning from Human Feedback: se entrena el modelo para preferir las respuestas consideradas mejores por humanos.
Términos relacionados
Aprendizaje profundo
Subcampo del aprendizaje automático que utiliza redes neuronales profundas para aprender representaciones complejas.
Machine Learning
Rama de la IA en la que los modelos aprenden patrones a partir de datos en lugar de seguir reglas explícitas.
Aprendizaje supervisado
Aprendizaje a partir de ejemplos etiquetados (entrada → salida esperada).
Aprendizaje no supervisado
Aprendizaje a partir de datos sin labels, donde el modelo descubre por sí mismo estructuras.
Última actualización: 15/7/2026