Inference Providers
Active filters: DPO
mradermacher/KoBioMed-Llama-3.1-8B-Instruct-i1-GGUF
8B • Updated • 1.51k
mradermacher/TC-instruct-DPO-GGUF
7B • Updated • 392
ytu-ce-cosmos/Turkish-Gemma-9b-v0.1
Text Generation
• 9B • Updated • 1.28k
• • 42
Text Generation
• 1B • Updated ALEXIOSTER/Humorous_DPO_LLama2_7b
Updated
tensorblock/tanamettpk_TC-instruct-DPO-GGUF
tensorblock/DiscoResearch_DiscoLM_German_7b_v1-GGUF
7B • Updated • 127
tensorblock/xDAN-AI_xDAN-L1-Chat-RL-v1-GGUF
Updated • 10
mradermacher/Turkish-Gemma-9b-v0.1-GGUF
9B • Updated • 595
• 2
mradermacher/Turkish-Gemma-9b-v0.1-i1-GGUF
9B • Updated • 1.24k
• 1
ETI-Deploy/DM-BaseModel-4Bit
Text Generation
• 73B • Updated • 7
Text Generation
• 9B • Updated • 27
• • 10
raniero/submission_dpo_ok_001
4.19M • Updated InfiX-ai/InfiAlign-Qwen-7B-DPO
Text Generation
• 8B • Updated • 26
• • 4
NamrataThakur/GPT2_355M_Perference-Fine-Tune_DPO
Question Answering
• Updated mradermacher/InfiAlign-Qwen-7B-DPO-GGUF
8B • Updated • 477
mradermacher/InfiAlign-Qwen-7B-DPO-i1-GGUF
8B • Updated • 1.15k
• 1
jorgedelpozolerida/Llama3-OpenBioLLM-8B-Q8_0-GGUF
8B • Updated • 1
prithivMLmods/ReasonFlux-Qwen3-dpo
Text Generation
• 2B • Updated • 17
• 1
mradermacher/ReasonFlux-Qwen3-dpo-GGUF
2B • Updated • 293
mradermacher/ReasonFlux-Qwen3-dpo-i1-GGUF
2B • Updated • 620
mradermacher/OpenBioLLm-70B-GGUF
71B • Updated • 446
mradermacher/OpenBioLLm-70B-i1-GGUF
71B • Updated • 1.1k
ytu-ce-cosmos/Turkish-Gemma-9b-T1
Text Generation
• 9B • Updated • 643
• • 180
John6666/ntrmix-blessed-v11-dpo-sdxl
Text-to-Image
• 3B • Updated • 1
SandLogicTechnologies/Hermes-2-Pro-Llama-3-8B-GGUF
Text Generation
• 8B • Updated • 62