Edit Models filters
Model Tree
Apps
Inference Providers
One-click Deployment
Models
33
Active filters: QuestionAnswering
JamieAi33/Phi-2-QLora
JamieAi33/Phi-2_PEFT
KakashiH/BashExplainer_Gemma
2KKLabs/Kaleidoscope_small_v1
2KKLabs/Kaleidoscope_large_v1
SEGAgentRL/LLDS-A-GRPO-Qwen2.5-7B-Ins
Reinforcement Learning • 8B • Updated • 26 • 2
SEGAgentRL/LLDS-A-GRPO-Qwen2.5-7B-Base
Reinforcement Learning • 8B • Updated • 30 • 2
SEGAgentRL/LLDS-A-GSPO-Qwen2.5-3B-Ins
Reinforcement Learning • 3B • Updated • 19 • 1
SEGAgentRL/LLDS-R-GSPO-Qwen2.5-3B-Ins
Reinforcement Learning • 3B • Updated • 13 • 1
SEGAgentRL/LLDS-R-GRPO-Qwen2.5-3B-Base
Reinforcement Learning • 3B • Updated • 10 • 1
SEGAgentRL/LLDS-A-GRPO-Qwen2.5-3B-Base-MA
Reinforcement Learning • 3B • Updated • 15 • 1
SEGAgentRL/LLDS-A-GRPO-Qwen2.5-3B-Base
Reinforcement Learning • 3B • Updated • 12
SEGAgentRL/LLDS-R-GRPO-Qwen2.5-3B-Ins
Reinforcement Learning • 3B • Updated • 16 • 1
mradermacher/LLDS-A-GSPO-Qwen2.5-3B-Ins-GGUF
3B • Updated • 328
mradermacher/LLDS-A-GRPO-Qwen2.5-7B-Base-GGUF
8B • Updated • 469 • 1
SEGAgentRL/LLDS-A-GRPO-Qwen2.5-3B-Ins
Reinforcement Learning • 3B • Updated • 14
mradermacher/LLDS-A-GRPO-Qwen2.5-7B-Base-i1-GGUF
8B • Updated • 1.14k • 2
mradermacher/LLDS-A-GRPO-Qwen2.5-7B-Ins-GGUF
8B • Updated • 239 • 1
mradermacher/LLDS-A-GRPO-Qwen2.5-3B-Base-GGUF
3B • Updated • 207
mradermacher/LLDS-A-GRPO-Qwen2.5-7B-Ins-i1-GGUF
8B • Updated • 830 • 1
mradermacher/LLDS-A-GRPO-Qwen2.5-3B-Ins-GGUF
3B • Updated • 292
mradermacher/LLDS-R-GRPO-Qwen2.5-3B-Ins-GGUF
3B • Updated • 295 • 1
mradermacher/LLDS-R-GRPO-Qwen2.5-3B-Base-GGUF
3B • Updated • 176 • 1
mradermacher/LLDS-A-GRPO-Qwen2.5-3B-Base-MA-GGUF
3B • Updated • 308 • 1
mradermacher/LLDS-R-GSPO-Qwen2.5-3B-Ins-GGUF
3B • Updated • 349 • 1
mradermacher/LLDS-R-GRPO-Qwen2.5-3B-Base-i1-GGUF
3B • Updated • 748 • 1
mradermacher/LLDS-A-GRPO-Qwen2.5-3B-Base-i1-GGUF
3B • Updated • 590
mradermacher/LLDS-A-GRPO-Qwen2.5-3B-Ins-i1-GGUF
3B • Updated • 579
mradermacher/LLDS-R-GRPO-Qwen2.5-3B-Ins-i1-GGUF
3B • Updated • 1.07k • 3