🦆
DuckWeights
Models
steven0226
/
qwen2.5-1.5b-wordle-grpo-merged
text-generation
safetensors
qwen2
reinforcement-learning
grpo
agentic-rl
multi-turn
License
apache-2.0
Size
not mirrored yet
Cataloged from
steven0226/qwen2.5-1.5b-wordle-grpo-merged
Model card
Files (0)
Use
This model has no card.
steven0226/qwen2.5-1.5b-wordle-grpo-merged · DuckWeights
Downloads in the last 30 days
0
/ 30 days