A Reinforcement Learning Calibration Benchmark of Tabular Q-Learning and One-Hot DQN on Enumerable Maze Navigation | Synapse