ONNX 模型库
返回模型

说明文档

PPO 智能体玩 Huggy

这是一个训练好的 PPO 智能体,使用 Unity ML-Agents 库 来玩 Huggy

使用方法(配合 ML-Agents)

文档地址:https://unity-technologies.github.io/ml-agents/ML-Agents-Toolkit-Documentation/

我们编写了完整的教程,教你如何使用 ML-Agents 训练你的第一个智能体并发布到 Hub:

  • 一个简短教程,教你让 Huggy 小狗 🐶 学会捡棍子,然后直接在浏览器中与它互动:https://huggingface.co/learn/deep-rl-course/unitbonus1/introduction
  • 一个更长的教程,帮助你深入理解 ML-Agents 的工作原理:https://huggingface.co/learn/deep-rl-course/unit5/introduction

继续训练

mlagents-learn <你的配置文件路径.yaml> --run-id=<运行id> --resume

观看你的智能体玩游戏

你可以直接在浏览器中观看你的智能体玩游戏

  1. 如果环境是 ML-Agents 官方环境之一,请访问 https://huggingface.co/unity
  2. 第一步:找到你的 model_id:Greedy-Squirrel/DRL-Course
  3. 第二步:选择你的 .nn /.onnx 文件
  4. 点击"观看智能体游玩"👀

Greedy-Squirrel/DRL-Course

作者 Greedy-Squirrel

reinforcement-learning ml-agents
↓ 1 ♥ 1

创建时间: 2024-10-24 19:43:11+00:00

更新时间: 2024-10-24 22:07:00+00:00

在 Hugging Face 上查看

文件 (41)

.gitattributes
Huggy.onnx ONNX
Huggy/Huggy-1199901.onnx ONNX
Huggy/Huggy-1199901.pt
Huggy/Huggy-1399978.onnx ONNX
Huggy/Huggy-1399978.pt
Huggy/Huggy-1599839.onnx ONNX
Huggy/Huggy-1599839.pt
Huggy/Huggy-1799909.onnx ONNX
Huggy/Huggy-1799909.pt
Huggy/Huggy-199815.onnx ONNX
Huggy/Huggy-199815.pt
Huggy/Huggy-1999952.onnx ONNX
Huggy/Huggy-1999952.pt
Huggy/Huggy-2000025.onnx ONNX
Huggy/Huggy-2000025.pt
Huggy/Huggy-399851.onnx ONNX
Huggy/Huggy-399851.pt
Huggy/Huggy-599989.onnx ONNX
Huggy/Huggy-599989.pt
Huggy/Huggy-799976.onnx ONNX
Huggy/Huggy-799976.pt
Huggy/Huggy-999968.onnx ONNX
Huggy/Huggy-999968.pt
Huggy/checkpoint.pt
Huggy/events.out.tfevents.1729804283.2cc70b322e13.14222.0
README.md
config.json
configuration.yaml
ppo-LunarLander-v2.zip
ppo-LunarLander-v2/_stable_baselines3_version
ppo-LunarLander-v2/data
ppo-LunarLander-v2/policy.optimizer.pth
ppo-LunarLander-v2/policy.pth
ppo-LunarLander-v2/pytorch_variables.pth
ppo-LunarLander-v2/system_info.txt
replay.mp4
results.json
run_logs/Player-0.log
run_logs/timers.json
run_logs/training_status.json