返回模型
说明文档
SoccerTwos 的 ML-Agents POCA 模型
这是一个使用 POCA(带中心化 Actor 的近端策略优化)算法为 Unity ML-Agents 的 SoccerTwos 环境训练的模型。
- 运行 ID:
Soccersend - 训练 ELO: 1532.72(约 500 万步时)
- 配置: 查看所有超参数请见
SoccerTwos.yaml。
使用方法(配合 ML-Agents):
- 下载
SoccerTwos.onnx和SoccerTwos.yaml文件。 - 创建文件夹结构
results/Soccersend/ - 将
SoccerTwos.onnx放入results/Soccersend/中 - 下载 SoccerTwos 环境。
- 运行推理命令:
mlagents-learn ./SoccerTwos.yaml --env= --run-id=Soccersend --inference --resume
Ray00007/mlagents-SoccerTwos-POCA-AIVS
作者 Ray00007
reinforcement-learning
mlagents
↓ 0
♥ 0
创建时间: 2025-10-30 14:01:55+00:00
更新时间: 2025-10-30 15:03:49+00:00
在 Hugging Face 上查看文件 (6)
.gitattributes
README.md
SoccerTwos
SoccerTwos.mp4
SoccerTwos.onnx
ONNX
SoccerTwos.yaml