返回模型
说明文档
PPO 智能体玩 Huggy
这是一个训练好的 PPO 智能体,使用 Unity ML-Agents 库 来玩 Huggy。
使用方法(配合 ML-Agents)
文档地址:https://unity-technologies.github.io/ml-agents/ML-Agents-Toolkit-Documentation/
我们编写了完整的教程,教你如何使用 ML-Agents 训练你的第一个智能体并发布到 Hub:
- 一个简短教程,教你让 Huggy 小狗 🐶 学会捡棍子,然后直接在浏览器中与它互动:https://huggingface.co/learn/deep-rl-course/unitbonus1/introduction
- 一个更长的教程,帮助你深入理解 ML-Agents 的工作原理:https://huggingface.co/learn/deep-rl-course/unit5/introduction
继续训练
mlagents-learn <你的配置文件路径.yaml> --run-id=<运行id> --resume
观看你的智能体玩游戏
你可以直接在浏览器中观看你的智能体玩游戏
- 如果环境是 ML-Agents 官方环境之一,请访问 https://huggingface.co/unity
- 第一步:找到你的 model_id:Greedy-Squirrel/DRL-Course
- 第二步:选择你的 .nn /.onnx 文件
- 点击"观看智能体游玩"👀
Greedy-Squirrel/DRL-Course
作者 Greedy-Squirrel
reinforcement-learning
ml-agents
↓ 1
♥ 1
创建时间: 2024-10-24 19:43:11+00:00
更新时间: 2024-10-24 22:07:00+00:00
在 Hugging Face 上查看文件 (41)
.gitattributes
Huggy.onnx
ONNX
Huggy/Huggy-1199901.onnx
ONNX
Huggy/Huggy-1199901.pt
Huggy/Huggy-1399978.onnx
ONNX
Huggy/Huggy-1399978.pt
Huggy/Huggy-1599839.onnx
ONNX
Huggy/Huggy-1599839.pt
Huggy/Huggy-1799909.onnx
ONNX
Huggy/Huggy-1799909.pt
Huggy/Huggy-199815.onnx
ONNX
Huggy/Huggy-199815.pt
Huggy/Huggy-1999952.onnx
ONNX
Huggy/Huggy-1999952.pt
Huggy/Huggy-2000025.onnx
ONNX
Huggy/Huggy-2000025.pt
Huggy/Huggy-399851.onnx
ONNX
Huggy/Huggy-399851.pt
Huggy/Huggy-599989.onnx
ONNX
Huggy/Huggy-599989.pt
Huggy/Huggy-799976.onnx
ONNX
Huggy/Huggy-799976.pt
Huggy/Huggy-999968.onnx
ONNX
Huggy/Huggy-999968.pt
Huggy/checkpoint.pt
Huggy/events.out.tfevents.1729804283.2cc70b322e13.14222.0
README.md
config.json
configuration.yaml
ppo-LunarLander-v2.zip
ppo-LunarLander-v2/_stable_baselines3_version
ppo-LunarLander-v2/data
ppo-LunarLander-v2/policy.optimizer.pth
ppo-LunarLander-v2/policy.pth
ppo-LunarLander-v2/pytorch_variables.pth
ppo-LunarLander-v2/system_info.txt
replay.mp4
results.json
run_logs/Player-0.log
run_logs/timers.json
run_logs/training_status.json