Tool AI Model Comparer Select 2-3 models for a side-by-side comparison.
Llama 4 Scout Meta · 109B (17B active MoE)
general
VRAM: 65.4GB (Q4) · 215.6GB (FP16)
Llama 4 Maverick Meta · 400B (17B active, 128 experts)
general
VRAM: 242.8GB (Q4) · 801.5GB (FP16)
Gemma 3 4B Google · 4B
vision
VRAM: 2.49GB (Q4) · 7.77GB (FP16)
Gemma 3 27B Google · 27B (also 1B/4B/12B)
vision
VRAM: 16.6GB (Q4) · 54.8GB (FP16)
Gemma 4 26B Google · 26B (4B active MoE)
general
VRAM: 17GB (Q4) · 50.5GB (FP16)
Gemma 4 E4B Google · E4B (8B raw, edge)
general
VRAM: 4.98GB (Q4) · 15.1GB (FP16)
Qwen 3 32B Alibaba · 32B
general
VRAM: 19.8GB (Q4) · 65.6GB (FP16)
Qwen 3 8B Alibaba · 8B
general
VRAM: 5.03GB (Q4) · 16.4GB (FP16)
Phi-4 Microsoft · 14B
general
VRAM: 9.05GB (Q4) · 29.3GB (FP16)
DeepSeek V3 DeepSeek · 671B (37B active MoE)
general
VRAM: 404.4GB (Q4) · 1342GB (FP16)
DeepSeek R1 DeepSeek · 14B distill (full R1: 671B MoE)
general
VRAM: 8.99GB (Q4) · 29.6GB (FP16)
Qwen3-Coder-Next Alibaba · 80B (3B active MoE)
coding
VRAM: 48.5GB (Q4) · 159.5GB (FP16)
Qwen2.5-Coder 32B Alibaba · 32B
coding
VRAM: 19.9GB (Q4) · 65.6GB (FP16)
Qwen2.5-Coder 7B Alibaba · 7B
coding
VRAM: 4.68GB (Q4) · 15.2GB (FP16)
DeepSeek-Coder V2 DeepSeek · 236B (21B active MoE)
coding
VRAM: 142.5GB (Q4) · 471.4GB (FP16)
StarCoder2 15B BigCode · 15B
coding
VRAM: 9.86GB (Q4) · 32GB (FP16)
CodeLlama 34B Meta · 34B
coding
VRAM: 20.2GB (Q4) · 67.4GB (FP16)
LLaVA 1.6 34B LLaVA Team · 34B
vision
VRAM: 20.7GB (Q4) · 69.6GB (FP16)
Gemma 3n E4B Google · 4B (edge-optimized)
vision
VRAM: 4.54GB (Q4) · 13.7GB (FP16)
Qwen2.5-VL 72B Alibaba · 72B
vision
VRAM: 47.4GB (Q4) · 145.4GB (FP16)
InternVL 2.5 78B OpenGVLab · 78B
vision
VRAM: 47.5GB (Q4) · 156.8GB (FP16)
Florence 2 Large Microsoft · 0.77B
vision
VRAM: 0.47GB (Q4) · 1.55GB (FP16)
Moondream 2 Moondream · 1.8B
vision
VRAM: 1.17GB (Q4) · 3.86GB (FP16)
all-MiniLM-L6-v2 Sentence Transformers · 22M
embedding
VRAM: 0.03GB (Q4) · 0.09GB (FP16)
Nomic Embed Text v1.5 Nomic AI · 137M
embedding
VRAM: 0.08GB (Q4) · 0.27GB (FP16)
BGE Large v1.5 BAAI · 335M
embedding
VRAM: 0.2GB (Q4) · 0.67GB (FP16)
GTE Base Alibaba DAMO · 109M
embedding
VRAM: 0.07GB (Q4) · 0.22GB (FP16)
Arctic Embed L v2 Snowflake · 568M
embedding
VRAM: 0.33GB (Q4) · 1.1GB (FP16)
FLUX.1 Dev Black Forest Labs · 12B
image-gen
VRAM: 7.27GB (Q4) · 24GB (FP16)
SDXL 1.0 Stability AI · 6.6B (2.6B UNet)
image-gen
VRAM: 1.97GB (Q4) · 6.5GB (FP16)
SDXL Turbo Stability AI · 6.6B
image-gen
VRAM: 1.97GB (Q4) · 6.5GB (FP16)
SD 3.5 Large Stability AI · 8B
image-gen
VRAM: 4.85GB (Q4) · 16GB (FP16)
Stable Cascade Stability AI · 5.1B (3-stage)
image-gen
VRAM: 3.03GB (Q4) · 10GB (FP16)
FLUX.1 Schnell Black Forest Labs · 12B
image-gen
VRAM: 7.27GB (Q4) · 24GB (FP16)
LTX Video Lightricks · 2B
video-gen
VRAM: 1.21GB (Q4) · 4GB (FP16)
Hunyuan Video Tencent · 13B
video-gen
VRAM: 7.88GB (Q4) · 26GB (FP16)
Cosmos 1.0 Diffusion 7B NVIDIA · 7B
video-gen
VRAM: 4.24GB (Q4) · 14GB (FP16)
WAN 2.1 T2V 14B WAN AI · 14B
video-gen
VRAM: 8.49GB (Q4) · 28GB (FP16)
Mochi 1 Genmo · 10B
video-gen
VRAM: 6.06GB (Q4) · 20GB (FP16)
Whisper Large v3 Turbo OpenAI · 809M
audio
VRAM: 0.48GB (Q4) · 1.6GB (FP16)
VRAM: 0.79GB (Q4) · 2.6GB (FP16)
MusicGen Large Meta · 3.3B
audio
VRAM: 2GB (Q4) · 6.6GB (FP16)
XTTS v2 Coqui · 0.5B
audio
VRAM: 0.3GB (Q4) · 1GB (FP16)
Parler TTS Large Parler TTS · 2.3B
audio
VRAM: 1.39GB (Q4) · 4.6GB (FP16)
BioMistral 7B BioMistral · 7B
specialized
VRAM: 4.37GB (Q4) · 14.5GB (FP16)
SaulLM 7B Equall · 7B
specialized
VRAM: 4.37GB (Q4) · 14.5GB (FP16)
DeepSeek-Math 7B DeepSeek · 7B
specialized
VRAM: 4.18GB (Q4) · 13.8GB (FP16)
Mistral 7B v0.3 Mistral AI · 7B
specialized
VRAM: 4.37GB (Q4) · 14.5GB (FP16)
Hermes 3 8B Nous Research · 8B
specialized
VRAM: 4.92GB (Q4) · 16.1GB (FP16)
Finance-LLM 13B TheBloke (quantized) · 13B
specialized
VRAM: 7.87GB (Q4) · 26GB (FP16)
Dolphin 2.9 8B Cognitive Computations · 8B
specialized
VRAM: 4.92GB (Q4) · 16.1GB (FP16)
Llama Guard 3 Meta · 8B
specialized
VRAM: 4.92GB (Q4) · 16.1GB (FP16)
OCRonos Vintage PleIAs · 124M
specialized
VRAM: 0.08GB (Q4) · 0.25GB (FP16)