AI 뉴스 Variance reduction for policy gradient with action-dependent factorized baselines 2018년 03월 20일 07:00 조회 10 Variance reduction for policy gradient with action-dependent factorized baselines 원문: https://openai.com/index/variance-reduction-for-policy-gradient-with-action-dependent-factorized-baselines