Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning | ArxivCSExplorer