SBEED
From MaRDI portal
Cited in
(18)- IterNet
- IMPALA
- An efficient algorithm for nonconvex-linear minimax optimization problem and its application in solving weighted maximin dispersion problem
- Fundamental design principles for reinforcement learning algorithms
- Policy space identification in configurable environments
- A backward SDE method for uncertainty quantification in deep learning
- TernGrad
- DSCOVR
- ckn_kernel
- Baselines
- A unified analysis of first-order methods for smooth games via integral quadratic constraints
- Fast global convergence of natural policy gradient methods with entropy regularization
- Sample complexity of sample average approximation for conditional stochastic optimization
- Efficient search of first-order Nash equilibria in nonconvex-concave smooth min-max problems
- First-order convergence theory for weakly-convex-weakly-concave min-max problems
- IQC-Game
- NC-OPT
- DualDICE
This page was built for software: SBEED