04:00
2026-08-21
arxiv.org
machine-learning
Learning Hierarchical Skill Policies with Offline Quality-Diversity Reinforcement Learning
Researchers introduced QDOS (Quality-Diversity Offline Skill learning), a unified pipeline for offline-to-online reinforcement learning that uses an Advantage-Weighted Quality-Diversity pretraining obโฆ