中国科学院数学与系统科学研究院期刊网
Last-Iterate Convergence to an Approximate Nash Equilibrium in Extensive-Form Games with Bandit Feedback and Variance Reduction
ZHU Kui, ZENG Xianlin, FANG Hao, HONG Yiguang
Last-Iterate Convergence to an Approximate Nash Equilibrium in Extensive-Form Games with Bandit Feedback and Variance Reduction
ZHU Kui, ZENG Xianlin, FANG Hao, HONG Yiguang
系统科学与复杂性(英文) . 2026, (): 0 .