ai|当AI开始踢球( 二 )


另外 , 通过模块化设计 , 该框架还能在不修改任何代码的情况下 , 一键切换单节点调试模式和多节点分布式训练模式 , 大大降低算法实现和训练的难度 。
94.4%的获胜率和场均3分的净胜分 。
在多智能体(GRF)游戏上的不同算法比较结果中 , TiKick的最终算法(+AW)以最高的获胜率(94.4%)和最大的目标差异达到了最佳性能 。
TrueSkill(机器学习中竞技类游戏的排名系统)得分也是第一 。
TiKick与内置AI的对战分别达到了94.4%的胜率和场均3分的净胜分 。

将TiKick与GRF学术场景中的基线算法进行横向比较后发现 , TiKick在所有场景下都达到了最佳性能和最低的样本复杂度 , 且差距明显 。
与其中的基线MAPPO相比还发现 , 在五个场景当中的四个场景都只需100万步就能达到最高分数 。