Inference Providers
Active filters: VLM
titanhacker/moondream-2b-Med-Vqa-Finetuned
2B • Updated • 17
• 1
AXERA-TECH/InternVL2_5-1B
Image-Text-to-Text
• Updated • 23
• 1
Efficient-Large-Model/VILA15-3b-hf-preview
Text Generation
• Updated • 17
Efficient-Large-Model/Llama-3-VILA15-8B-hf-preview
Text Generation
• Updated • 23
Efficient-Large-Model/VILA15-13b-hf-preview
Text Generation
• Updated • 15
Efficient-Large-Model/VILA15-40b-hf-preview
Text Generation
• Updated • 20
TIGER-Lab/ABC-Qwen2VL-Instruct
Image-Text-to-Text
• Updated • 19
AXERA-TECH/SmolVLM-256M-Instruct
Updated • 28
• 2
JettZhou/PhysVLM-Qwen2.5-3B
4B • Updated • 16
• 2
di-zhang-fdu/eagle2-9B-forked
Image-Text-to-Text
• 9B • Updated MLAdaptiveIntelligence/LLaVAction-7B
Video-Text-to-Text
• 8B • Updated • 91
• 1
AXERA-TECH/Qwen2.5-VL-3B-Instruct
Image-Text-to-Text
• Updated • 49
• 1
prithivMLmods/Callisto-OCR3-2B-Instruct
Image-Text-to-Text
• 2B • Updated • 88
• 7
Image-Text-to-Text
• 8B • Updated • 17.7k
• 50
4B • Updated • 63
• 4
mradermacher/TongUI-3B-GGUF
3B • Updated • 365
TianheWu/VisualQuality-R1-7B-preview
Reinforcement Learning
• 8B • Updated • 31
• 7
mm-eval/Llama-3-LongVILA-8B-512Frames
Text Generation
• Updated • 14
mradermacher/ImageQuality-R1-v1-GGUF
8B • Updated • 492
mradermacher/ImageQuality-R1-v1-i1-GGUF
8B • Updated • 1.17k
• 1
Image-Text-to-Text
• 0.2B • Updated • 356
• 103
nvidia/VILA-HD-8B-PS3-1.5K-SigLIP
Image-Text-to-Text
• Updated • 257
• 4
nvidia/VILA-HD-8B-PS3-4K-SigLIP
Image-Text-to-Text
• Updated • 236
• 2
One-RL-to-See-Them-All/Orsta-7B
Image-Text-to-Text
• 8B • Updated • 451
• 14
One-RL-to-See-Them-All/Orsta-32B-0321
Image-Text-to-Text
• 33B • Updated • 21
• 3
One-RL-to-See-Them-All/Orsta-32B-0326
Image-Text-to-Text
• 33B • Updated • 24
• 9
TianheWu/VisualQuality-R1-7B
Reinforcement Learning
• 8B • Updated • 2.86k
• 16
mradermacher/Orsta-7B-GGUF
Reinforcement Learning
• 8B • Updated • 569
mradermacher/Orsta-32B-0326-GGUF
33B • Updated • 401
mradermacher/Orsta-32B-0321-GGUF
33B • Updated • 496