Данная работа представляет собой систематический обзор (scoping review) применения методов обучения с подкреплением (Reinforcement Learning, RL) для оптимизации протоколов лечения сепсиса. Исследование анализирует, как алгоритмы ИИ могут использоваться для динамического принятия решений в критических состояниях, когда требуется точная дозировка вазопрессоров и инфузионная терапия. В обзоре рассматриваются различные архитектуры нейронных сетей и подходы к моделированию среды пациента, что критически важно для снижения смертности при сепсисе. Авторы систематизируют текущие достижения в области использования RL, выделяя переход от статических клинических рекомендаций к персонализированным адаптивным стратегиям. Основное внимание уделяется методологическим сложностям, таким как проблема смещения данных и необходимость валидации алгоритмов на реальных клинических данных (offline RL). Работа подчеркивает огромный потенциал ИИ в поддержке принятия врачебных решений в отделениях интенсивной терапии, предлагая дорожную карту для будущих клинических испытаний.