Conceptual

Communicating Unexpectedness in Out-of-Distribution Multi-Agent Reinforcement Learning

A decentralized MARL algorithm in which each agent predicts its next observation, measures the discrepancy against the observation actually seen, and broadcasts that prediction-error 'unexpectedness' as a message alongside reward-driven communication, so cooperating agents adapt robustly to situations outside their training distribution.