Hugging Face Hub ahora cuenta con un espacio especial para entornos de aprendizaje por refuerzo (RL), lo que permite a los sistemas de inteligencia artificial agente acceder a nuevas capacidades y medir y mejorar su rendimiento. Los entornos son datasets que se pueden ejecutar en diferentes frameworks, como Harbor, Verifiers y NVIDIA NeMo Gym, y pueden ser utilizados para entrenar modelos de aprendizaje por refuerzo. La plataforma ya alberga entornos de aprendizaje por refuerzo y permite a los usuarios encontrar y ejecutarlos de manera sencilla.