D
Data
Text
FORM: Learning Expressive and Transferable First-Order Logic Reward Machines
This paper introduces First-Order Reward Machines (FORMs), an extension of reward machines for reinforcement learning that addresses non-Markovian rewards. Traditional reward machines label the edges…