EXPLORE CONNECTIONS
Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs
Follow the relationships that help you find your next source.
Based on 525 indexed works selected for this snapshot; the candidate window is limited. Counts describe this index, not the complete source archives. Prepared from the PostgreSQL corpus; source versions are checked before display. Snapshot 2026-09-27. Up to 32 works or names per graph.
Subjects & research connections
Connections use shared source subjects, names, places, and explicitly mentioned entities. A shared label is not evidence of a citation, experimental result, or verified species identification.
Relationships as a list (31)
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs Jingqing Ruan · Xuantang Xiong 2. CoSLight: Co-optimizing Collaborator Selection and Decision-making to Enhance Traffic Signal Control
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs Jingqing Ruan 3. Reboost Large Language Model-based Text-to-SQL, Text-to-Python, and Text-to-Function -- with Real Applications in Traffic Domain
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 4. Explainable Machine Learning in Deployment
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 5. Prompt Tuning Large Language Models on Personalized Aspect Extraction for Recommendations
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 6. CDR: Conservative Doubly Robust Learning for Debiased Recommendation
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 7. A Probabilistic Approach for Model Alignment with Human Comparisons
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 8. An Initial Introduction to Cooperative Multi-Agent Reinforcement Learning
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 9. Generating Interesting Scientific Ideas using Knowledge Graphs and LLMs: Evaluations with 100 Research Group Leaders
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 10. Transductive Off-policy Proximal Policy Optimization
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 11. AIR: Analytic Imbalance Rectifier for Continual Learning
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 12. Foundations of Large Language Models
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 13. Time-Varying Bayesian Optimization Without a Metronome
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 14. Multimodal AI predicts clinical outcomes of drug combinations from preclinical data
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 15. The kernel of graph indices for vector search
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 16. Enabling Approximate Joint Sampling in Diffusion LMs
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 17. Self-Localizing MIMO Beam Mapping with Continuously Evolving Channel Memory
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 18. Few-Shot Specific Emitter Identification via Integrated Complex Variational Mode Decomposition and Spatial Attention Transfer
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 19. On Cost-Aware Designs for Sequential Hypothesis Testing
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 20. TIDE: Temporal Incremental Draft Engine for Self-Improving LLM Inference
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 21. Quantum Attention by Overlap Interference: Predicting Classical and Many-Body Quantum Sequences
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 22. TabSieve: Explicit In-Table Evidence Selection for Tabular Prediction
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 23. Gradient Networks for Universal Magnetic Modeling of Synchronous Machines
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 24. RQ-Reg: A Residual-Quantization-Based Framework for Continuous Value Prediction in Recommender Systems
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 25. Learning Causal Structure of Time Series using Best Order Score Search
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 26. Safety Under Scaffolding: How Evaluation Conditions Shape Measured Safety
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 27. MultiwayPAM: Multiway Partitioning Around Medoids for LLM-as-a-Judge Score Analysis
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 28. Beyond Pairwise Attention: Higher-Order Modular Attention for Efficient Sequence Learning
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 29. MemGuard-Alpha: Limits of Membership Inference for Detecting and Filtering Memorization-Contaminated Signals in LLM-Based Financial Forecasting
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 30. Invertible Query-Key Coupling Composes with Attention Mechanisms
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 31. LiveMathematicianBench: A Live Benchmark for Research-Level Mathematical Reasoning with Proof Sketches
- 1. Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs cs.LG 32. IatroBench: A Pre-Registered Benchmark of Clinical Omission in Language Models
Citation graph
Arrows run from the citing work to its reference. Only explicit source/provider reference lists are used. Incoming links cover this candidate window; this is not a global citation count.
No supported relationships are available in this snapshot. This does not mean that no relationships exist.
Collaborator network
Shared authorship within up to 200 candidate works (3 examined); up to 32 names shown. Names are matched as supplied, without verified person disambiguation. Shared credit does not necessarily establish personal collaboration.
Relationships as a list (30)
- 5. Qingyang Zhang 1 shared work 6. Yiming Yang
- 1. Jingqing Ruan 1 shared work 5. Qingyang Zhang
- 5. Qingyang Zhang 1 shared work 2. Xuantang Xiong
- 4. Dengpeng Xing 1 shared work 5. Qingyang Zhang
- 3. Bo Xu 1 shared work 5. Qingyang Zhang
- 1. Jingqing Ruan 1 shared work 6. Yiming Yang
- 2. Xuantang Xiong 1 shared work 6. Yiming Yang
- 4. Dengpeng Xing 1 shared work 6. Yiming Yang
- 3. Bo Xu 1 shared work 6. Yiming Yang
- 1. Jingqing Ruan 2 shared works 2. Xuantang Xiong
- 4. Dengpeng Xing 1 shared work 1. Jingqing Ruan
- 3. Bo Xu 1 shared work 1. Jingqing Ruan
- 4. Dengpeng Xing 1 shared work 2. Xuantang Xiong
- 3. Bo Xu 1 shared work 2. Xuantang Xiong
- 3. Bo Xu 1 shared work 4. Dengpeng Xing
- 10. Guanghu Sui 1 shared work 1. Jingqing Ruan
- 1. Jingqing Ruan 1 shared work 15. Zhishuai Li
- 1. Jingqing Ruan 2 shared works 9. Ziyue Li
- 1. Jingqing Ruan 1 shared work 14. Sun Yang
- 7. Hangyu Mao 2 shared works 1. Jingqing Ruan
- 1. Jingqing Ruan 2 shared works 8. Rui Zhao
- 12. Hua Wei 1 shared work 1. Jingqing Ruan
- 11. Haoyuan Jiang 1 shared work 1. Jingqing Ruan
- 13. Jiaming Lu 1 shared work 1. Jingqing Ruan
- 2. Xuantang Xiong 1 shared work 9. Ziyue Li
- 12. Hua Wei 1 shared work 2. Xuantang Xiong
- 11. Haoyuan Jiang 1 shared work 2. Xuantang Xiong
- 13. Jiaming Lu 1 shared work 2. Xuantang Xiong
- 7. Hangyu Mao 1 shared work 2. Xuantang Xiong
- 8. Rui Zhao 1 shared work 2. Xuantang Xiong
Publication timeline
Publication years for these 32 related works; 0 have no source publication date. This is a discovery sample, not a measure of research output or growth.
2020 · 1 work
2023 · 4 works
- Balancing Exploration and Exploitation in Hierarchical Reinforcement Learning via Latent Landmark Graphs
- Reboost Large Language Model-based Text-to-SQL, Text-to-Python, and Text-to-Function -- with Real Applications in Traffic Domain
- Prompt Tuning Large Language Models on Personalized Aspect Extraction for Recommendations
- CDR: Conservative Doubly Robust Learning for Debiased Recommendation
2024 · 1 work
2026 · 26 works
- A Probabilistic Approach for Model Alignment with Human Comparisons
- An Initial Introduction to Cooperative Multi-Agent Reinforcement Learning
- Generating Interesting Scientific Ideas using Knowledge Graphs and LLMs: Evaluations with 100 Research Group Leaders
- Transductive Off-policy Proximal Policy Optimization
- AIR: Analytic Imbalance Rectifier for Continual Learning
- Foundations of Large Language Models
- Time-Varying Bayesian Optimization Without a Metronome
- Multimodal AI predicts clinical outcomes of drug combinations from preclinical data
- The kernel of graph indices for vector search
- Enabling Approximate Joint Sampling in Diffusion LMs
- Self-Localizing MIMO Beam Mapping with Continuously Evolving Channel Memory
- Few-Shot Specific Emitter Identification via Integrated Complex Variational Mode Decomposition and Spatial Attention Transfer
- On Cost-Aware Designs for Sequential Hypothesis Testing
- TIDE: Temporal Incremental Draft Engine for Self-Improving LLM Inference
- Quantum Attention by Overlap Interference: Predicting Classical and Many-Body Quantum Sequences
- TabSieve: Explicit In-Table Evidence Selection for Tabular Prediction
- Gradient Networks for Universal Magnetic Modeling of Synchronous Machines
- RQ-Reg: A Residual-Quantization-Based Framework for Continuous Value Prediction in Recommender Systems
- Learning Causal Structure of Time Series using Best Order Score Search
- Safety Under Scaffolding: How Evaluation Conditions Shape Measured Safety
- MultiwayPAM: Multiway Partitioning Around Medoids for LLM-as-a-Judge Score Analysis
- Beyond Pairwise Attention: Higher-Order Modular Attention for Efficient Sequence Learning
- MemGuard-Alpha: Limits of Membership Inference for Detecting and Filtering Memorization-Contaminated Signals in LLM-Based Financial Forecasting
- Invertible Query-Key Coupling Composes with Attention Mechanisms
- LiveMathematicianBench: A Live Benchmark for Research-Level Mathematical Reasoning with Proof Sketches
- IatroBench: A Pre-Registered Benchmark of Clinical Omission in Language Models
Semantic map
Model: all-minilm. Positions are a two-dimensional approximation of embedding similarity; proximity is not a citation or proof of agreement. Results come from the snapshot’s candidate window.
No current, compatible embeddings are available for related works in this snapshot. A semantic map appears after background embedding and snapshot generation.