Inference ve fine-tuning’i planlayın — donanım, VRAM ve maliyet.
Açık kaynak LLM'leri yüzlerce modellik katalogla karşılaştırın; canlı bulut fiyatları, TCO ve token maliyeti analizi. Giriş gerekmez, ücretsizdir.
Hemen Hesapla →Hesaplayıcı Modülleri
01
ACTIVE
INFERENCE
Çıkarım Hesaplayıcı
TTFT, TPOT, token/s ve VRAM — 8B’den 671B MoE’ye; canlı bulut fiyatları ve TCO.
02
ACTIVE
FINE-TUNING
Fine-Tuning Hesaplayıcı
QLoRA, LoRA ve tam ince ayar için GPU süresi, VRAM ve platform maliyeti.
Gerçek senaryolar, gerçek rakamlar
Bu kartlar sunucuda aynı hesap motoruyla hesaplanır; her biri uygulamada düzenlenebilir.
Meta Llama 3.3 70B
1× NVIDIA H100 SXM5 (80GB HBM3)
~30 tok/s
$0.36 / 1M tok
74 GB VRAM
Qwen 3 32B
1× NVIDIA GeForce RTX 4090 (24GB GDDR6X)
~39 tok/s
$0.08 / 1M tok
18 GB VRAM
Meta Llama 3.1 8B
1× NVIDIA GeForce RTX 4090 (24GB GDDR6X)
~109 tok/s
$0.08 / 1M tok
7 GB VRAM
Qwen 3 30B-A3B (MoE)
1× NVIDIA GeForce RTX 5090 (32GB GDDR7)
~575 tok/s
$0.11 / 1M tok
17 GB VRAM
Google Gemma 3 27B (Multimodal)
1× NVIDIA RTX 6000 Ada Generation (48GB ECC)
~22 tok/s
$0.09 / 1M tok
30 GB VRAM
Qwen 3 235B-A22B (MoE)
2× NVIDIA H200 SXM (141GB HBM3e)
~289 tok/s
$0.99 / 1M tok
243 GB VRAM
Mistral Small 3 (24B Instruct)
1× NVIDIA GeForce RTX 4090 (24GB GDDR6X)
~52 tok/s
$0.08 / 1M tok
14 GB VRAM
Qwen 3 8B
1× NVIDIA GeForce RTX 3090 (24GB GDDR6X)
~101 tok/s
$0.05 / 1M tok
7 GB VRAM
Çıkarım (Inference)
TTFT, TPOT, token/s ve VRAM — 8B’den 671B MoE’ye kadar.
Fine-Tuning
QLoRA, LoRA ve tam ince ayar için GPU süresi, VRAM ve platform maliyeti.
Canlı Bulut Fiyatları
RunPod, Lambda ve Modal’dan anlık GPU fiyatları; on-prem TCO kıyası.
125 katalogdaki açık kaynak model