Description:
Variant: Tabular Q-Learning; Hysteretic Q-Learning; Fitted Q-Iteration; Multi-Step Q-Learning; Speedy Q-Learning
Field: Reinforcement Learning
Sector/Industry: Operations and Logistics
Category: Sequential Decision Making
Sub-category: Value and Policy Learning
Sub-domain: Control and adaptive decision making
Source: Curated documented AI algorithm and genuine-variant registry; Watkins and Dayan 1992; Sutton and Barto 2018; Mnih et al. 2015; Schulman et al. 2017; Haarnoja et al. 2018
__source_file: excels\1k_algos.csv
Share this link via
Or copy link























