This is a theoretical computer science contribution presenting a novel algorithmic framework with mathematical guarantees, not an empirical clinical or translational study; it advances understanding of learning in game-theoretic settings but requires experimental validation and practical implementation.
Reported
Sample complexityÕ(R²ₘₐₓ H⁴ |S|² |A| / (p_reach ε²))
Equilibrium approximation guarant…ε-approximate NE with social-welfare value…
Algorithmic terminationPolynomial number of trajectory samples