Tool AI Model Comparer Select 2-3 models for a side-by-side comparison.
Llama 4 Scout Meta · 109B (17B active MoE)
general
VRAM: 35GB (Q4) · 218GB (FP16)
Llama 4 Maverick Meta · 400B (17B active, 128 experts)
general
VRAM: 130GB (Q4) · 800GB (FP16)
Gemma 3 4B Google · 4B
vision
VRAM: 3GB (Q4) · 8GB (FP16)
Gemma 3 27B Google · 27B (also 1B/4B/12B)
vision
VRAM: 16GB (Q4) · 54GB (FP16)
Gemma 4 27B Google · 27B
general
VRAM: 14GB (Q4) · 54GB (FP16)
Gemma 4 E4B Google · 4B
general
VRAM: 2.3GB (Q4) · 8GB (FP16)
Qwen 3 32B Alibaba · 32B
general
VRAM: 16GB (Q4) · 64GB (FP16)
Qwen 3 8B Alibaba · 8B
general
VRAM: 4.5GB (Q4) · 16GB (FP16)
Phi-4 Microsoft · 14B
general
VRAM: 7GB (Q4) · 28GB (FP16)
DeepSeek V3 DeepSeek · 671B (37B active MoE)
general
VRAM: 220GB (Q4) · 1342GB (FP16)
DeepSeek R1 DeepSeek · 671B (MoE) / 7B-32B distilled
general
VRAM: 10GB (Q4) · 28GB (FP16)
Qwen3-Coder-Next Alibaba · 80B (3B active MoE)
coding
VRAM: 28GB (Q4) · 160GB (FP16)
Qwen2.5-Coder 32B Alibaba · 32B
coding
VRAM: 16GB (Q4) · 64GB (FP16)
Qwen2.5-Coder 7B Alibaba · 7B
coding
VRAM: 4GB (Q4) · 14GB (FP16)
DeepSeek-Coder V2 DeepSeek · 236B (21B active MoE)
coding
VRAM: 80GB (Q4) · 472GB (FP16)
StarCoder2 15B BigCode · 15B
coding
VRAM: 8GB (Q4) · 30GB (FP16)
CodeLlama 34B Meta · 34B
coding
VRAM: 17GB (Q4) · 68GB (FP16)
LLaVA 1.6 34B LLaVA Team · 34B
vision
VRAM: 17GB (Q4) · 68GB (FP16)
Gemma 3n E4B Google · 4B (edge-optimized)
vision
VRAM: 2.3GB (Q4) · 8GB (FP16)
Qwen2.5-VL 72B Alibaba · 72B
vision
VRAM: 35GB (Q4) · 144GB (FP16)
InternVL 2.5 78B OpenGVLab · 78B
vision
VRAM: 36GB (Q4) · 156GB (FP16)
Florence 2 Large Microsoft · 0.77B
vision
VRAM: 0.4GB (Q4) · 1.5GB (FP16)
Moondream 2 Moondream · 1.8B
vision
VRAM: 1GB (Q4) · 3.6GB (FP16)
all-MiniLM-L6-v2 Sentence Transformers · 22M
embedding
VRAM: 0.03GB (Q4) · 0.09GB (FP16)
Nomic Embed Text v1.5 Nomic AI · 137M
embedding
VRAM: 0.07GB (Q4) · 0.27GB (FP16)
BGE Large v1.5 BAAI · 335M
embedding
VRAM: 0.16GB (Q4) · 0.67GB (FP16)
GTE Base Alibaba DAMO · 109M
embedding
VRAM: 0.05GB (Q4) · 0.22GB (FP16)
Arctic Embed L v2 Snowflake · 568M
embedding
VRAM: 0.27GB (Q4) · 1.1GB (FP16)
FLUX.1 Dev Black Forest Labs · 12B
image-gen
VRAM: 6GB (Q4) · 24GB (FP16)
SDXL 1.0 Stability AI · 6.6B (2.6B UNet)
image-gen
VRAM: 1.8GB (Q4) · 6.5GB (FP16)
SDXL Turbo Stability AI · 6.6B
image-gen
VRAM: 1.8GB (Q4) · 6.5GB (FP16)
SD 3.5 Large Stability AI · 8B
image-gen
VRAM: 4.5GB (Q4) · 16GB (FP16)
Stable Cascade Stability AI · 5.1B (3-stage)
image-gen
VRAM: 2.5GB (Q4) · 10GB (FP16)
FLUX.1 Schnell Black Forest Labs · 12B
image-gen
VRAM: 6GB (Q4) · 24GB (FP16)
LTX Video Lightricks · 2B
video-gen
VRAM: 1GB (Q4) · 4GB (FP16)
Hunyuan Video Tencent · 13B
video-gen
VRAM: 7GB (Q4) · 26GB (FP16)
Cosmos 1.0 Diffusion 7B NVIDIA · 7B
video-gen
VRAM: 4GB (Q4) · 14GB (FP16)
WAN 2.1 T2V 14B WAN AI · 14B
video-gen
VRAM: 7GB (Q4) · 28GB (FP16)
Mochi 1 Genmo · 10B
video-gen
VRAM: 5GB (Q4) · 20GB (FP16)
Whisper Large v3 Turbo OpenAI · 809M
audio
VRAM: 0.4GB (Q4) · 1.6GB (FP16)
VRAM: 0.7GB (Q4) · 2.6GB (FP16)
MusicGen Large Meta · 3.3B
audio
VRAM: 1.8GB (Q4) · 6.6GB (FP16)
XTTS v2 Coqui · 0.5B
audio
VRAM: 0.25GB (Q4) · 1GB (FP16)
Parler TTS Large Parler TTS · 2.3B
audio
VRAM: 1.2GB (Q4) · 4.6GB (FP16)
BioMistral 7B BioMistral · 7B
specialized
VRAM: 4GB (Q4) · 14GB (FP16)
SaulLM 7B Equall · 7B
specialized
VRAM: 4GB (Q4) · 14GB (FP16)
DeepSeek-Math 7B DeepSeek · 7B
specialized
VRAM: 4GB (Q4) · 14GB (FP16)
Mistral 7B v0.3 Mistral AI · 7B
specialized
VRAM: 4GB (Q4) · 14GB (FP16)
Hermes 3 8B Nous Research · 8B
specialized
VRAM: 4.5GB (Q4) · 16GB (FP16)
Finance-LLM 13B TheBloke (quantized) · 13B
specialized
VRAM: 6.5GB (Q4) · 26GB (FP16)
Dolphin 2.9 8B Cognitive Computations · 8B
specialized
VRAM: 4.5GB (Q4) · 16GB (FP16)
Llama Guard 3 Meta · 8B
specialized
VRAM: 4.5GB (Q4) · 16GB (FP16)
OCRonos Vintage PleIAs · 7B
specialized
VRAM: 4GB (Q4) · 14GB (FP16)