Inference Providers
Active filters: dpo
SongTonyLi/OpenELM-270M-SFT-D1_chosen-then-DPO-D2a-HuggingFaceH4-ultrafeedback_binarized-Xlarge
Text Generation
• 0.3B • Updated • 18
abhishekunnamdce/Llama-2-7b-hf-fine-tuned-DPO
NanQiangHF/llama3_8b_instruct_dpo_bwgenerator
8B • Updated • 3
DUAL-GPO/zephyr-7b-ipo-0k-15k-i1
tanliboy/lambda-qwen2.5-14b-dpo-test
Text Generation
• 15B • Updated • 42
• • 10
Katayoon/VPO-Pess-SELM-Zephyr-7B-iter-1
7B • Updated • 6
Katayoon/VPO-Pess-SELM-Zephyr-7B-iter-2
7B • Updated • 7
v000000/Qwen2.5-Lumen-14B
Text Generation
• 15B • Updated • 112
• • 21
v000000/Qwen2.5-14B-Gutenberg-Instruct-Slerpeno
Text Generation
• 15B • Updated • 63
• • 7
v000000/Qwen2.5-14B-Gutenberg-1e-Delta
Text Generation
• 15B • Updated • 56
• • 4
v000000/Qwen2.5-Lumen-14B-Q6_K-GGUF
Text Generation
• 15B • Updated • 74
• 1
Lambent/Qwen2.5-Lumen-14B-Q4_K_M-GGUF
Text Generation
• 15B • Updated • 24
• 2
mradermacher/Qwen2.5-14B-Gutenberg-Instruct-Slerpeno-GGUF
15B • Updated • 1.59k
• 3
v000000/Qwen2.5-14B-Gutenberg-1e-Delta-Q6_K-GGUF
15B • Updated • 33
• 1
NanQiangHF/llama3_8b_instruct_dpo_bwgenerator_v2
8B • Updated • 3
SongTonyLi/OpenELM-450M-SFT-D1_chosen-then-DPO_D2a-HuggingFaceH4-ultrafeedback_binarized-Xlarge
Text Generation
• 0.5B • Updated • 13
dasChronos1/Qwen2.5-Lumen-14B-Q8_0-GGUF
Text Generation
• 15B • Updated • 40
tanliboy/lambda-llama-3-8b-dpo-test-orca
Text Generation
• 8B • Updated • 19
mradermacher/Qwen2.5-14B-Gutenberg-Instruct-Slerpeno-i1-GGUF
15B • Updated • 1.41k
• 3
SongTonyLi/OpenELM-1_1B-SFT-D1_chosen-then-DPO_D2a-HuggingFaceH4-ultrafeedback_binarized-Xlarge
Text Generation
• 1B • Updated • 17
QuantFactory/Qwen2.5-Lumen-14B-GGUF
Text Generation
• 15B • Updated • 291
• 3
mradermacher/Qwen2.5-Lumen-14B-GGUF
15B • Updated • 1.82k
• 5
tanliboy/lambda-llama-3-8b-ipo-test
Text Generation
• 8B • Updated • 18
• 1
QuantFactory/Qwen2.5-14B-Gutenberg-Instruct-Slerpeno-GGUF
15B • Updated • 508
• 2
QuantFactory/Qwen2.5-14B-Gutenberg-1e-Delta-GGUF
15B • Updated • 940
• 2
tanliboy/lambda-qwen2.5-32b-dpo-test
Text Generation
• 33B • Updated • 36
• • 5
mradermacher/Qwen2.5-Lumen-14B-i1-GGUF
15B • Updated • 2.79k
• 8
taicheng/zephyr-7b-align-scan-dpo0.1data-5e-07-0.01-1-cosine-8
Text Generation
• 7B • Updated • 11
QuantFactory/L3.1-Niitorm-8B-DPO-t0.0001-GGUF
8B • Updated • 101
• 3
LBK95/Llama-2-7b-hf-DPO-LookAhead3_FullEval_TTree1.4_TLoop0.7_TEval0.2_Filter0.2_V3.0
Updated • 11