Bandit-Optimization
This code uses reinforcement learning, specifically the multi-armed bandit approach, for reaction optimization. It demonstrates data-efficient learning at high accuracies and has unique functionalities.
Publications
Wang JY, Stevens JM, Kariofillis SK, Tom MJ, Golden DL, Li J, Tabora JE, Parasram M, Shields BJ, Primer DN, Hao B. Identifying general reaction conditions by bandit optimization. Nature. 2024, 626, 1025-1033. doi.org/10.1038/s41586-024-07021-y