Research graph
References from DARQ: Diffusion-Augmented Regularized Q-Updates for offline goal-conditioned reinforcement learning with soft switching policy fusion. Local targets link to admitted publications; unresolved targets remain external evidence.
Vapor: Legged robot navigation in unstructured outdoor environments using offline reinforcement learning
2024 · External reference
On-robot reinforcement learning with goal-contrastive rewards
2025 · External reference
Causal deconfounding deep reinforcement learning for mobile robot motion planning
10.1016/j.knosys.2024.112406 · 2024 · External reference
DiffSkill: Improving reinforcement learning through diffusion-based skill denoiser for robotic manipulation
10.1016/j.knosys.2024.112190 · 2024 · External reference
Multithreaded asynchronous deep reinforcement learning with multisensor fusion for robot collision avoidance
10.1109/tnnls.2025.3556438 · 2025 · External reference
Unresolved reference
2019 · External reference
Hindsight experience replay
2017 · External reference
A transformation-aggregation framework for state representation of autonomous driving systems
10.1109/tits.2023.3348489 · 2024 · External reference
Unresolved reference
2022 · External reference
Offline goal-conditioned reinforcement learning via f-advantage regression
10.52202/068431-0023 · 2022 · External reference
Learn zero-constraint-violation safe policy in model-free constrained reinforcement learning.
2024 · External reference
Unresolved reference
External reference
Unresolved reference
2021 · External reference
Offline goal-conditioned reinforcement learning for safety-critical tasks with recovery policy
2024 · External reference
Constraints penalized q-learning for safe offline reinforcement learning
2022 · External reference
Unresolved reference
2022 · External reference
Denoising diffusion probabilistic models
2020 · External reference
Policy optimization by looking ahead for model-based offline reinforcement learning
2024 · External reference
Improving offline reinforcement learning with in-sample advantage regularization for robot manipulation
2024 · External reference
Unresolved reference
2017 · External reference
Highly valued subgoal generation for efficient goal-conditioned reinforcement learning
10.1016/j.neunet.2024.106825 · 2025 · External reference
A goal-conditioned offline reinforcement learning algorithm and its application to quad-rotors
10.1016/j.engappai.2025.110678 · 2025 · External reference
Unresolved reference
2021 · External reference
Unresolved reference
2023 · External reference
10.1145/3637528.3671638
10.1145/3637528.3671638 · External reference
Model-based off-policy deep reinforcement learning with model-embedding
10.1109/tetci.2024.3369636 · 2024 · External reference
Recovery rl: Safe reinforcement learning with learned recovery zones
10.1109/lra.2021.3070252 · 2021 · External reference
Safe offline reinforcement learning with real-time budget constraints
2023 · External reference
A review of safe reinforcement learning: Methods, theories and applications
10.1109/tpami.2024.3457538 · 2024 · External reference
Constraint-adaptive policy switching for offline safe reinforcement learning
2025 · External reference
Unresolved reference
2024 · External reference
Risk-constrained reinforcement learning with percentile risk criteria
2018 · External reference
Batch policy learning under constraints
2019 · External reference
Constrained decision transformer for offline safe reinforcement learning
2023 · External reference
Balancing therapeutic effect and safety in ventilator parameter recommendation: An offline reinforcement learning approach
10.1016/j.engappai.2023.107784 · 2024 · External reference
Shielded planning guided data-efficient and safe reinforcement learning
10.1109/tnnls.2024.3359031 · 2024 · External reference
Deep reinforcement learning for robotics: A survey of real-world successes
2025 · External reference
Deep reinforcement learning: A survey
10.1109/tnnls.2022.3207346 · 2024 · External reference
Unresolved reference
2022 · External reference
Neuronlike adaptive elements that can solve difficult learning control problems
10.1109/tsmc.1983.6313077 · 2012 · External reference
Unresolved reference
2021 · External reference
Unresolved reference
2013 · External reference
Unresolved reference
2018 · External reference
Mujoco: A physics engine for model-based control
2012 · External reference
Unresolved reference
2024 · External reference
Unresolved reference
2019 · External reference
QFAE: Q-function guided action exploration for offline deep reinforcement learning
10.1016/j.patcog.2024.111032 · 2025 · External reference
Balancing therapeutic effect and safety in ventilator parameter recommendation: An offline reinforcement learning approach
10.1016/j.engappai.2023.107784 · ExternalCitation · doi-reference
A goal-conditioned offline reinforcement learning algorithm and its application to quad-rotors
10.1016/j.engappai.2025.110678 · ExternalCitation · doi-reference
DiffSkill: Improving reinforcement learning through diffusion-based skill denoiser for robotic manipulation
10.1016/j.knosys.2024.112190 · ExternalCitation · doi-reference
Causal deconfounding deep reinforcement learning for mobile robot motion planning
10.1016/j.knosys.2024.112406 · ExternalCitation · doi-reference
Highly valued subgoal generation for efficient goal-conditioned reinforcement learning
10.1016/j.neunet.2024.106825 · ExternalCitation · doi-reference
QFAE: Q-function guided action exploration for offline deep reinforcement learning
10.1016/j.patcog.2024.111032 · ExternalCitation · doi-reference
Recovery rl: Safe reinforcement learning with learned recovery zones
10.1109/lra.2021.3070252 · ExternalCitation · doi-reference
Model-based off-policy deep reinforcement learning with model-embedding
10.1109/tetci.2024.3369636 · ExternalCitation · doi-reference
A transformation-aggregation framework for state representation of autonomous driving systems
10.1109/tits.2023.3348489 · ExternalCitation · doi-reference
Deep reinforcement learning: A survey
10.1109/tnnls.2022.3207346 · ExternalCitation · doi-reference
Shielded planning guided data-efficient and safe reinforcement learning
10.1109/tnnls.2024.3359031 · ExternalCitation · doi-reference
Multithreaded asynchronous deep reinforcement learning with multisensor fusion for robot collision avoidance
10.1109/tnnls.2025.3556438 · ExternalCitation · doi-reference
A review of safe reinforcement learning: Methods, theories and applications
10.1109/tpami.2024.3457538 · ExternalCitation · doi-reference
Neuronlike adaptive elements that can solve difficult learning control problems
10.1109/tsmc.1983.6313077 · ExternalCitation · doi-reference
10.1145/3637528.3671638
10.1145/3637528.3671638 · ExternalCitation · doi-reference
Offline goal-conditioned reinforcement learning via f-advantage regression
10.52202/068431-0023 · ExternalCitation · doi-reference