· 2 min czytania
Optymalizacja pracy call center za pomocą uczenia ze wzmocnieniem: PPO kontra Value Iteration
PPO kontra Value Iteration w symulacji call center ze skills-based routingiem: PPO daje krótsze kolejki, mniej bezczynności agentów i najwyższe nagrody RL.