强化学习 最前沿之MARL(二)值分解方法

强化学习-Zee最前沿系列

深度强化学习作为当前发展最快的方向,可以说是百家争鸣的时代。针对特定问题,针对特定环境的文章也层出不穷。对于这么多的文章和方向,如果能撇一隅,往往也能够带来较多的启发。
本系列文章,主要是针对当前较新的深度强化学习算法和Trick,浅析其思路和方法,可以帮助你找出新的思路。希望对大家有多帮助。
另外,我会将所有的文章及所做的一些简单项目,放在我的个人网页上。
此系列传送门
水平有限,可能有理解不到位的地方,希望大家主动沟通交流。
邮箱:[email protected]

基于值分解方法的多智能体强化学习算法

最近工作太多了。没有时间写Blog,所以就把 之前做的PPT上传了把。
可能会做的比较粗略。仅供参考。

强化学习 最前沿之MARL(二)值分解方法_第1张图片
强化学习 最前沿之MARL(二)值分解方法_第2张图片
强化学习 最前沿之MARL(二)值分解方法_第3张图片
强化学习 最前沿之MARL(二)值分解方法_第4张图片
强化学习 最前沿之MARL(二)值分解方法_第5张图片
强化学习 最前沿之MARL(二)值分解方法_第6张图片
强化学习 最前沿之MARL(二)值分解方法_第7张图片
强化学习 最前沿之MARL(二)值分解方法_第8张图片
强化学习 最前沿之MARL(二)值分解方法_第9张图片
强化学习 最前沿之MARL(二)值分解方法_第10张图片

你可能感兴趣的:(强化学习-最前沿)