显示第 11089-11100 项,共 38250 个模型
mbalabash/distilbert_subjects_actions_objects_descriptors
mbalabash
↓ 4
♥ 0
amd/AMD-OLMo-1B-SFT-DPO-awq-asym-uint4-g128-lmhead-onnx-hybrid
amd
↓ 4
♥ 0
Sil3ntt/ppo-SnowballTarget
Sil3ntt
reinforcement-learning
ml-agents
↓ 4
♥ 0
Heysell/ppo-Huggy
Heysell
reinforcement-learning
ml-agents
↓ 4
♥ 0
Subarashi/ppo-Pyramids
Subarashi
reinforcement-learning
ml-agents
↓ 4
♥ 0
stuti-srinath/ppo-Huggy
stuti-srinath
reinforcement-learning
ml-agents
↓ 4
♥ 0
mku64/SmolLM2-360M-Instruct-Q3-mlx
mku64
text-generation
transformers
↓ 4
♥ 0
Ceniza2/ppo-Huggy
Ceniza2
reinforcement-learning
ml-agents
↓ 4
♥ 0
Xharos/ppo-SnowballTarget
Xharos
reinforcement-learning
ml-agents
↓ 4
♥ 0
Geraldine/Gemini-Distill-Qwen2.5-0.5B-ead-ONNX
Geraldine
text-generation
transformers.js
↓ 4
♥ 0
togu6669/ppo-Pyramid
togu6669
reinforcement-learning
ml-agents
↓ 4
♥ 0
guife33/poca-SoccerTwos
guife33
reinforcement-learning
ml-agents
↓ 4
♥ 0