Scalable trust-region method for deep reinforcement learning using Kronecker-factored approximation
Yuhuai Wu, Elman Mansimov, Shun Liao, Roger Grosse, Jimmy Ba
原文 arXiv:1708.05144;中英对照 + 大白话阅读 https://aha.fim.ai/paper/1708.05144v2
贴一个 arxiv 链接,中英对照 + 大白话,把论文读懂。