Featured

Library

MASA Safe-RL

Modular library for safe RL, providing baselines for a number of constraints using a variety of algorithms.

Safe RLLibraryBenchmarksConstraints

By year

2026

Tool

Behaviour Policy Optimization

Off-policy policy optimisation using a learned behaviour policy to reduce the variance of return estimates.

Reinforcement learningOff-policyPolicy optimisationVariance reduction
Tool

Contract Shielding

Compositional shielding for safe multi-agent reinforcement learning with decentralised execution.

Safe RLMulti-agentShieldingCompositional
Tool

SafeAdapt

Policy updates for continual reinforcement learning with certified safety on previously learned tasks.

Safe RLContinual learningCertificationPolicy updates

2025

Tool

GR(1) Shielding

Adaptive shielding for reinforcement learning that repairs GR(1) specifications after environment assumption violations.

ShieldingGR(1)Spec repairSafe RL
Library

MASA Safe-RL

Modular library for safe RL, providing baselines for a number of constraints using a variety of algorithms.

Safe RLLibraryBenchmarksConstraints
Tool

Quantitative Reward Monitoring

Reward monitoring for reinforcement learning from specifications expressed in quantitative temporal logic.

Reward specsQuantitative LTLMonitoringRL

2023

Tool

Approximate Model-Based Shielding

Model-based shielding for safe reinforcement learning using learned latent dynamics.

Safe RLShieldingModel-basedVerification