Ollama VRAM Requirements and RTX 3090 Benchmarks

Compare 601 local LLM profiles by minimum VRAM, optimal VRAM, RTX 3090 speed, system RAM target, and whether the model is safe to run locally or better rented on cloud GPUs.

Start here if you are searching for "how much VRAM does this Ollama model need", "can it run on RTX 3090", or "which local LLM fits 24GB VRAM".

Ollama naming/source alignment date: 2026-02-24. Each profile links back to its Ollama library source.

Use VRAM Calculator Compatibility Matrix Multimodal Hub Sample Compare Page

Fast Answers for High-Intent Searches

601

Total profiles

16

Group hubs

19

Measured profiles

582

Estimated profiles

285

SC keywords recycled

19

Top curated models

Top 20 Curated (Ollama Popular)

Rank Model Tag VRAM Q4 VRAM Q5 System RAM RTX 3090 fit Category Command
1 Qwen3 Coder qwen3-coder:30b 20GB 22GB 32GB+ Comfortable Coding ollama run qwen3-coder:30b
2 Qwen3.6 qwen3.6:35b 22GB 24GB 32GB+ Comfortable Reasoning ollama run qwen3.6:35b
3 Qwen3.5 qwen3.5:35b 22GB 24GB 32GB+ Comfortable Reasoning ollama run qwen3.5:35b
4 GPT-OSS gpt-oss:20b 16GB 20GB 32GB+ Comfortable Reasoning ollama run gpt-oss:20b
6 Gemma4 gemma4:26b 18GB 22GB 32GB+ Comfortable Multimodal / General ollama run gemma4:26b
7 Llama 4 llama4:16x17b 40GB 48GB 64GB+ Cloud / larger GPU Multimodal / MoE ollama run llama4:16x17b
8 Qwen3 qwen3:32b 20GB 24GB 32GB+ Comfortable Coding / Reasoning ollama run qwen3:32b
9 Qwen3 qwen3:14b 12GB 14GB 32GB+ Comfortable Coding / Reasoning ollama run qwen3:14b
10 Qwen3 qwen3:8b 8GB 10GB 16GB+ Comfortable Coding / Chat ollama run qwen3:8b
11 Magistral magistral:24b 18GB 22GB 32GB+ Comfortable Reasoning ollama run magistral:24b
12 Ministral 3 ministral-3:14b 12GB 14GB 32GB+ Comfortable Reasoning / Chat ollama run ministral-3:14b
13 Nemotron 3 Nano nemotron-3-nano:30b 20GB 24GB 32GB+ Comfortable Reasoning / Chat ollama run nemotron-3-nano:30b
14 Qwen3.5 qwen3.5:122b 70GB 80GB 128GB+ Cloud / larger GPU Reasoning / Large ollama run qwen3.5:122b
15 Qwen3 Coder qwen3-coder:480b 215GB 230GB 128GB+ Cloud / larger GPU Coding / Large ollama run qwen3-coder:480b
16 GPT-OSS gpt-oss:120b 70GB 80GB 128GB+ Cloud / larger GPU Reasoning / Large ollama run gpt-oss:120b
17 Qwen3 VL qwen3-vl:32b 20GB 24GB 32GB+ Comfortable Multimodal / Vision ollama run qwen3-vl:32b
18 Llama 3.3 llama3.3:70b 40GB 48GB 64GB+ Cloud / larger GPU General Chat ollama run llama3.3:70b
19 DeepSeek-R1 deepseek-r1:32b 20GB 24GB 32GB+ Comfortable Reasoning / Math ollama run deepseek-r1:32b
20 Gemma 3 gemma3:12b 12GB 14GB 32GB+ Comfortable Multimodal / General ollama run gemma3:12b

Group Hubs

Featured high-demand models

Model VRAM (min/optimal) System RAM RTX 3090 fit 3090 tok/s Path
Llama 4 128X17B Q4 418GB / 428GB 128GB+ Cloud / larger GPU 1.1 View
Llama 4 128X17B Q5 420GB / 430GB 128GB+ Cloud / larger GPU 1 View
Llama 4 128X17B Q8 424GB / 434GB 128GB+ Cloud / larger GPU 0.8 View
Llama 4 128X17B FP16 430GB / 442GB 128GB+ Cloud / larger GPU 0.6 View
DeepSeek-R1 671B Q4 418GB / 428GB 128GB+ Cloud / larger GPU 1.1 View
DeepSeek-R1 671B Q5 420GB / 430GB 128GB+ Cloud / larger GPU 1 View
DeepSeek-R1 671B Q8 424GB / 434GB 128GB+ Cloud / larger GPU 0.8 View
DeepSeek-R1 671B FP16 430GB / 442GB 128GB+ Cloud / larger GPU 0.6 View

Search Console feedback loop

Top keywords feeding daily content and model page updates.

Keyword Clicks Impressions CTR Landing
how much vram for llama 2 7b fp16 0 23 0% /ar/models/llama2-7b-fp16/
llama 2 7b fp16 vram requirement 0 17 0% /ar/models/llama2-7b-fp16/
llama 2 7b fp16 vram requirements 0 3 0% /ar/models/llama2-7b-fp16/
how much vram llama 2 7b fp16 0 2 0% /ar/models/llama2-7b-fp16/
qwen 1.8b 0 2 0% /ar/models/qwen-18b-q8/
deepseek coder 6.7b 0 1 0% /ar/models/deepseek-coder-67b-q8/
glm-4.7-flash vram 0 1 0% /ar/models/glm-47-flash-7b-q8/
how much vram ram needed for llama 2 7b fp16 0 1 0% /ar/models/llama2-7b-fp16/
llama 2 7b fp16 vram requirement 16gb 0 1 0% /ar/models/llama2-7b-fp16/
llama 3 70b vram requirements 0 1 0% /ar/models/llama3-70b-q8/
qwen 14b vram 0 1 0% /ar/models/qwen25-coder-14b-q8/
qwen 2.5 coder 14b requirements 0 1 0% /ar/models/qwen25-coder-14b-q8/
qwen 3.5 35b vram 0 1 0% /ar/models/qwen35-35b-q8/
qwen-1.8b 0 1 0% /ar/models/qwen-18b-q8/
qwen2.5 coder 0.5b 0 1 0% /ar/models/qwen25-coder-05b-q8/
qwen2.5:14b size 0 1 0% /ar/models/qwen25-coder-14b-q8/
qwen2dvae 0 1 0% /ar/models/qwen25-72b-q8/
qwen3 235b requirements 0 1 0% /ar/models/qwen3-235b-q8/
qwen3 235b vram 0 1 0% /ar/models/qwen3-235b-q8/
qwen3 4b fp16 0 1 0% /ar/models/qwen3-4b-fp16/
qwen3 vram 0 1 0% /ar/models/qwen3-4b-q8/
vram 0 13 0% /de/tools/vram-calculator/
conversion trichter 0 10 0% /de/status/conversion-funnel/
vram 0 5 0% /de/
v ram 0 3 0% /de/tools/vram-calculator/
vram test 0 3 0% /de/tools/vram-calculator/
qwen3-coder 30b q4 0 2 0% /de/models/qwen3-coder-30b-q4/
qwen3-coder-30b 0 2 0% /de/models/qwen3-coder-30b-q4/
vram test 0 2 0% /de/
cluster lokale gruppe 0 1 0% /de/guides/ollama-local-cluster-network/
cluster lokale konten 0 1 0% /de/guides/ollama-local-cluster-network/
how much vram does a 3090 have 0 1 0% /de/hardware/verified-3090/
how much vram does the 3090 have 0 1 0% /de/hardware/verified-3090/
qwen coder 30b 0 1 0% /de/models/qwen3-coder-30b-q4/
qwen3 4b 0 1 0% /de/models/qwen3-4b-q8/
qwen3 4b fp8 0 1 0% /de/models/qwen3-4b-q8/
qwen3 coder 30b 0 1 0% /de/models/qwen3-coder-30b-q4/
vram. 0 1 0% /de/
vram. 0 1 0% /de/tools/vram-calculator/
ai83090 0 700 0% /en/models/
ai83090 0 50 0% /en/updates/
best rag models 0 18 0% /en/guides/best-rag-models/
"search–space complexity" "performance–model acceleration" llama-2-7b rtx 3090 0 15 0% /en/models/
"search–space complexity" "performance–model acceleration" llama-2-7b rtx 3090 0 15 0% /en/status/
"search-space complexity" "performance-model acceleration" llama-2-7b rtx 3090 0 10 0% /en/models/
"search-space complexity" "performance-model acceleration" llama-2-7b rtx 3090 0 10 0% /en/status/
ai83090 0 7 0% /en/hardware/verified-3090/
best llm for 16gb vram 0 4 0% /en/blog/16gb-vram-model-selection-guide/
deepseek r1 14b quantized vram requirement 0 3 0% /en/models/deepseek-r1-14b-q5/
dual rtx 3090 70b q4 tokens per second llama.cpp benchmark 0 3 0% /en/models/llama-70b-q4/
gemma3 latency use case 0 3 0% /en/blog/model-gemma3-27b-local-benchmark/
best coding model 16gb vram 0 2 0% /en/guides/best-coding-models/
best coding model for 24gb vram 0 2 0% /en/guides/best-coding-models/
best local llms for 16gb vram 0 2 0% /en/blog/16gb-vram-model-selection-guide/
best models for 24gb vram 0 2 0% /en/blog/best-24gb-vram-models-2026/
gemma 2 27b vram requirements quantized 0 2 0% /en/models/
how to check your vram 0 2 0% /en/tools/vram-calculator/
llama 2 7b memory requirements 0 2 0% /en/models/
locam.vx 0 2 0% /en/
lovram 0 2 0% /en/
my vram 0 2 0% /en/tools/vram-calculator/
ollama model for 16gb ram 0 2 0% /en/models/
best local llm for coding 2026 16gb vram 1 1 100% /en/guides/best-coding-models/
"search–space complexity" "performance–model acceleration" "llama-2-7b" 0 1 0% /en/models/
"search–space complexity" "performance–model acceleration" "llama-2-7b" 0 1 0% /en/status/
14b model vram 0 1 0% /en/models/
3090 fp8 0 1 0% /en/hardware/verified-3090/
36gb vram 0 1 0% /en/tools/vram-calculator/
ai83090 0 1 0% /en/blog/
best 12b coding model 0 1 0% /en/guides/best-coding-models/
best 12b model 0 1 0% /en/guides/best-coding-models/
best 12b model 0 1 0% /en/guides/best-rag-models/
best 16gb vram model 0 1 0% /en/blog/16gb-vram-model-selection-guide/
best 32b model for coding 0 1 0% /en/guides/best-coding-models/
best coding llm for 16gb vram 0 1 0% /en/blog/16gb-vram-model-selection-guide/
best coding model for 24gb vram 0 1 0% /en/blog/best-24gb-vram-models-2026/
best coding model for 6gb vram 0 1 0% /en/guides/best-coding-models/
best coding model for 8gb vram 0 1 0% /en/guides/best-coding-models/
best coding models right now 0 1 0% /en/guides/best-coding-models/
best fim model 0 1 0% /en/guides/best-coding-models/
best llm 16gb vram 0 1 0% /en/blog/16gb-vram-model-selection-guide/
best llm for rag 0 1 0% /en/guides/best-rag-models/
best local ai model for 16gb vram 0 1 0% /en/blog/16gb-vram-model-selection-guide/
best local coding model for 16gb vram 0 1 0% /en/blog/16gb-vram-model-selection-guide/
best local llm 16gb vram 0 1 0% /en/blog/16gb-vram-model-selection-guide/
best local llm for 16gb gpu 0 1 0% /en/blog/16gb-vram-model-selection-guide/
best local llm for 16gb ram 0 1 0% /en/blog/16gb-vram-model-selection-guide/
best local model for 16gb vram 0 1 0% /en/blog/16gb-vram-model-selection-guide/
best local model for 24gb vram 0 1 0% /en/blog/best-24gb-vram-models-2026/
best ollama model for 6gb vram 0 1 0% /en/models/
best rag model 0 1 0% /en/guides/best-rag-models/
best small llm for rag 0 1 0% /en/guides/best-rag-models/
best small model for rag 0 1 0% /en/guides/best-rag-models/
gemma 2 27b vram requirements 0 1 0% /en/models/
gemma 2 27b vram requirements 0 1 0% /en/models/gemma2-27b-q5/
gemma4 vram requirements 0 1 0% /en/models/gemma4-26b-q4/
how much does it weight 0 1 0% /en/models/starcoder2-7b-q4/
how much vram for gemma 4 0 1 0% /en/models/gemma4-26b-q4/
how to check how much vram you have 0 1 0% /en/tools/vram-calculator/
how to check my vram 0 1 0% /en/tools/vram-calculator/
llama 2 7b memory requirements fp16 ram vram size 0 1 0% /en/models/
llm for 16gb vram 0 1 0% /en/blog/16gb-vram-model-selection-guide/
local llm 16gb ram 0 1 0% /en/blog/16gb-vram-model-selection-guide/
ollama cluster 0 1 0% /en/guides/ollama-local-cluster-network/
ollama deepseek-coder-v2 16b size 0 1 0% /en/models/deepseek-coder-v2-16b-fp16/
ollama deepseek-r1 14b size 0 1 0% /en/models/deepseek-r1-14b-q5/
ollama deepseek-r1:14b model size 0 1 0% /en/models/deepseek-r1-14b-q5/
ollama gemma 3 4b memory requirements 0 1 0% /en/models/
ollama model for 8gb vram 0 1 0% /en/models/
ollama model memory requirements 7b 14b 32b official 0 1 0% /en/models/
ollama model vram requirements 0 1 0% /en/models/
ollama models for 16gb ram 0 1 0% /en/models/
ollama models for 16gb vram 0 1 0% /en/models/
ollama models for 8gb vram 0 1 0% /en/models/
ollama qwen2.5-coder 14b q4 size 0 1 0% /en/models/qwen25-coder-14b-q4/
ollama qwen2.5-coder tags 7b size 0 1 0% /en/models/qwen25-coder-7b-q4/
ollama qwen2.5-coder:14b size 0 1 0% /en/models/qwen25-coder-14b-fp16/
ollama vram calculator 0 1 0% /en/models/
q8 vs q4 quantization 0 1 0% /en/tools/quantization-blind-test/
qwen2.5-coder 32b ollama vram requirements 0 1 0% /en/models/
qwen2.5-coder model sizes vram requirements ollama 0 1 0% /en/models/
qwen3 14b q4_k_m vram usage ollama 0 1 0% /en/models/
qwen3 235b vram 0 1 0% /en/models/qwen3-4b-q5/
qwen3 4b requirements 0 1 0% /en/models/qwen3-4b-q5/
qwen3 vram 0 1 0% /en/models/qwen3-4b-q5/
qwen3.6 35b a3b rtx 3090 tokens per second benchmark 0 1 0% /en/blog/daily-local-llm-benchmark-snapshot-2026-07-14/
qwen_2.5_vl_7b_fp16 0 1 0% /en/models/
recommended quantized models for 8gb vram 2026 0 1 0% /en/blog/best-24gb-vram-models-2026/
rtx 4090 llm 0 1 0% /en/blog/rtx4090-vs-rtx3090-for-local-llm/
vllm vs ollama 0 1 0% /en/guides/ollama-vs-vllm-vram/
vram download 0 1 0% /en/tools/vram-calculator/
vram needed for gemma 4 0 1 0% /en/models/gemma4-26b-q4/
vram tool 0 1 0% /en/tools/vram-calculator/
vrm calculator 0 1 0% /en/tools/vram-calculator/
what is my vram size 0 1 0% /en/tools/vram-calculator/
лучшие модели для rag 0 1 0% /en/guides/best-rag-models/
ai83090 0 100 0% /es/status/
ai83090 0 30 0% /es/hardware/verified-3090/
ai30790 0 9 0% /es/hardware/verified-3090/
llama 2 7b vram requirement fp16 0 6 0% /es/models/llama2-7b-fp16/
how much vram llama 2 7b fp16 0 5 0% /es/models/llama2-7b-fp16/
gpt oss 120b memory requirements 0 4 0% /es/models/gpt-oss-120b-q5/
vram 0 3 0% /es/
vram 0 2 0% /es/tools/vram-calculator/
671b 0 1 0% /es/models/deepseek-r1-671b-q8/
cudamalloc failed: out of memory 0 1 0% /es/errors/cuda-out-of-memory/
deepseek coder 6.7b 0 1 0% /es/models/deepseek-coder-67b-q8/
gpt oss 120b how much vram 0 1 0% /es/models/gpt-oss-120b-q5/
healthrun 0 1 0% /es/status/runner-health/
how much vram for 120b model 0 1 0% /es/models/gpt-oss-120b-q5/
llama 2 7b fp16 vram requirements 0 1 0% /es/models/llama2-7b-fp16/
my vram 0 1 0% /es/
my vram 0 1 0% /es/tools/vram-calculator/
quantifying 0 1 0% /es/tools/quantization-blind-test/
qwen 14b q4 0 1 0% /es/models/qwen-14b-q4/
qwen3.5 vit 0 1 0% /es/models/qwen3-17b-q5/
rtx 3090 scan 0 1 0% /es/hardware/verified-3090/
vllm vs ollama 0 1 0% /es/guides/ollama-vs-vllm-vram/
vram como saber 0 1 0% /es/
vrams 0 1 0% /es/
vrams 0 1 0% /es/tools/vram-calculator/
apple silicon llm 0 7 0% /fr/hardware/apple-silicon-llm-guide/
cuda out of memory 0 6 0% /fr/errors/cuda-out-of-memory/
hub multimodal 0 6 0% /fr/multimodal/
matrice de compatibilité 0 6 0% /fr/matrix/
entonnoir en anglais 0 4 0% /fr/status/conversion-funnel/
ollama vs vllm 0 3 0% /fr/guides/ollama-vs-vllm-vram/
vram 0 3 0% /fr/tools/vram-calculator/
entonnoir anglais 0 2 0% /fr/status/conversion-funnel/
localllama 0 2 0% /fr/blog/
location gpu 0 2 0% /fr/affiliate/cloud-gpu/
data freshness 0 1 0% /fr/status/data-freshness/
deepseek coder 33b fp16 memory requirement 0 1 0% /fr/models/deepseek-coder-33b-fp16/
deepseek coder 33b fp16 memory requirements 0 1 0% /fr/models/deepseek-coder-33b-fp16/
llama 2 70b fp16 memory size gb 0 1 0% /fr/models/llama2-70b-fp16/
qwen 32b vram requirements 0 1 0% /fr/models/qwen25-coder-32b-q4/
qwen2.5-coder 32b q4_k_m 0 1 0% /fr/models/qwen25-coder-32b-q4/
qwen3 4b int8 0 1 0% /fr/models/qwen3-4b-q8/
qwen3-coder-30b requirements 0 1 0% /fr/models/qwen3-coder-30b-q4/
set vram 0 1 0% /fr/tools/vram-calculator/
thry vram 0 1 0% /fr/models/
vpngram 0 1 0% /fr/tools/vram-calculator/
vram 0 1 0% /fr/
vram cloud 0 1 0% /fr/affiliate/cloud-gpu/
vram2 0 1 0% /fr/guides/ollama-vs-vllm-vram/
vram2 0 1 0% /fr/tools/vram-calculator/
deepseek r1 8b requirements 0 1 0% /hi/models/deepseek-r1-8b-q4/
llama 3.3 vram requirements 0 1 0% /hi/models/llama33-70b-q8/
qwen 12gb vram 0 1 0% /hi/models/qwen-72b-q4/
qwen3 235b requirements 0 2 0% /id/models/qwen3-235b-q5/
qwen3 32b q4 vram usage 0 2 0% /id/models/qwen3-32b-q4/
good vram 0 1 0% /id/tools/vram-calculator/
gpt oss 120b memory requirements 0 1 0% /id/models/gpt-oss-120b-q5/
how much vram llama 2 70b fp16 0 1 0% /id/models/llama2-70b-fp16/
how much vram needed for llama 2 70b fp16 0 1 0% /id/models/llama2-70b-fp16/
llama 2 70b fp16 memory size 0 1 0% /id/models/llama2-70b-fp16/
llama 2 70b fp16 memory size gb 0 1 0% /id/models/llama2-70b-fp16/
llama 2 70b memory requirements fp16 0 1 0% /id/models/llama2-70b-fp16/
llama 2 70b parameters memory fp16 size 0 1 0% /id/models/llama2-70b-fp16/
llama 3.3 70b vram requirements 0 1 0% /id/models/llama3-70b-q4/
lowvram 0 1 0% /id/
ollama qwen2.5 14b model size official 0 1 0% /id/models/qwen25-coder-14b-q5/
qwen3 235b a22b hardware requirements 0 1 0% /id/models/qwen3-235b-q5/
reserve vram 0 1 0% /id/tools/vram-calculator/
データ 鮮度 0 9 0% /ja/status/data-freshness/
データ鮮度 0 5 0% /ja/status/data-freshness/
ブラインドテスト 0 4 0% /ja/tools/quantization-blind-test/
cuda out of memory 0 3 0% /ja/errors/cuda-out-of-memory/
mixtral 8x7b vram requirements 0 2 0% /ja/models/mixtral-8x7b-q4/
cuda error out of memory 0 1 0% /ja/errors/cuda-out-of-memory/
data freshness 0 1 0% /ja/status/data-freshness/
mixtral 8x7b 4-bit vram requirement 0 1 0% /ja/models/mixtral-8x7b-q4/
ollama cluster 0 1 0% /ja/blog/ollama-local-cluster-network-checklist/
qwen 2.5 coder 7b system requirements 0 1 0% /ja/models/qwen25-coder-7b-fp16/
コンバージョンファネルとは 0 1 0% /ja/status/conversion-funnel/
ai83090 0 52 0% /ko/blog/
데이터 신선도 0 39 0% /ko/status/data-freshness/
3090 vram 0 30 0% /ko/blog/still-the-vram-king-rtx-3090-2026/
rtx 3090 vram 0 6 0% /ko/blog/still-the-vram-king-rtx-3090-2026/
qwen3 4b q4 0 3 0% /ko/models/qwen3-4b-q4/
3090vram 0 2 0% /ko/hardware/verified-3090/
qwen-1.8b 0 2 0% /ko/models/qwen-18b-fp16/
qwen3 8b q4 0 2 0% /ko/models/qwen3-8b-q4/
3090 vram 0 1 0% /ko/hardware/verified-3090/
36gb vram 0 1 0% /ko/hardware/
70b q4 0 1 0% /ko/models/codellama-70b-q4/
gemma 3 4b 0 1 0% /ko/models/gemma3-4b-q4/
gemma 3-4b 0 1 0% /ko/models/gemma3-4b-q4/
gemma3 12b 0 1 0% /ko/models/gemma3-12b-fp16/
gemma3-12b 0 1 0% /ko/models/gemma3-12b-fp16/
gemma4 e2b q4 0 1 0% /ko/models/gemma4-e2b-q4/
how much vram does a 3090 have 0 1 0% /ko/hardware/verified-3090/
how much vram does the 3090 have 0 1 0% /ko/hardware/verified-3090/
llama 3.3 70b 0 1 0% /ko/models/llama33-70b-q4/
llama 3.3 70b 0 1 0% /ko/models/llama33-70b-q5/
local llm 16gb vram 0 1 0% /ko/blog/16gb-vram-model-selection-guide/
minicpm-v 8b 0 1 0% /ko/models/minicpm-v-8b-q8/
nvidia 3090 vram 0 1 0% /ko/blog/still-the-vram-king-rtx-3090-2026/
phi4:14b 0 1 0% /ko/models/phi4-reasoning-14b-q4/
qwen 1.8b 0 1 0% /ko/models/qwen-18b-fp16/
qwen 32b 0 1 0% /ko/models/qwen-32b-q8/
qwen 4 4b 0 1 0% /ko/models/qwen-4b-q4/
qwen fp16 0 1 0% /ko/models/qwen-18b-fp16/
qwen-32b 0 1 0% /ko/models/qwen-32b-q8/
qwen/qwen3-8b-fp8 0 1 0% /ko/models/qwen3-8b-q8/
qwen2 5 coder 7b 0 1 0% /ko/models/qwen25-coder-7b-q4/
qwen3 vl 8b 0 1 0% /ko/models/qwen3-vl-8b-cloud/
qwen3 vl 8b 0 1 0% /ko/models/qwen3-vl-8b-fp16/
qwen3-vl-8b 0 1 0% /ko/models/qwen3-vl-8b-cloud/
qwen3-vl-8b 0 1 0% /ko/models/qwen3-vl-8b-fp16/
rtx 3090 vram 0 1 0% /ko/hardware/verified-3090/
site:ollama.com/library/qwen3-coder 30b ollama 0 1 0% /ko/models/group/30b-34b/
vram 16gb llm 0 1 0% /ko/blog/16gb-vram-model-selection-guide/
vram rtx 3090 0 1 0% /ko/hardware/verified-3090/
vram 0 4 0% /pt/tools/vram-calculator/
gpt oss 120b memory requirements 0 3 0% /pt/models/gpt-oss-120b-q5/
vram 0 2 0% /pt/
14b q4 0 1 0% /pt/models/qwen3-14b-q4/
deepseek coder 33b fp16 vram requirement 0 1 0% /pt/models/deepseek-coder-33b-fp16/
gpt oss 120b ram requirements 0 1 0% /pt/models/gpt-oss-120b-q5/
localllama 0 1 0% /pt/blog/
mixtral 8x7b 4-bit vram requirement 0 1 0% /pt/models/mixtral-8x7b-q5/
ollama run qwen2.5:0.5b 0 1 0% /pt/models/qwen25-05b-fp16/
qwen3 14b q4 vram usage 0 1 0% /pt/models/qwen3-14b-q4/
qwen3 vram 0 1 0% /pt/models/qwen3-17b-fp16/
vram como ver 0 1 0% /pt/
vram como ver 0 1 0% /pt/tools/vram-calculator/
ai83090 0 6 0% /ru/hardware/verified-3090/
rtx 3090 2026 1 1 100% /ru/blog/still-the-vram-king-rtx-3090-2026/
1024mb vram 0 1 0% /ru/tools/vram-calculator/
30b model vram requirements 0 1 0% /ru/models/qwen3-coder-30b-q4/
ai30908 0 1 0% /ru/hardware/verified-3090/
cuda error out of memory 0 1 0% /ru/errors/cuda-out-of-memory/
cuda out of memory 0 1 0% /ru/errors/cuda-out-of-memory/
cuda out of memory. 0 1 0% /ru/errors/cuda-out-of-memory/
deepseek coder 6.7b 0 1 0% /ru/models/deepseek-coder-67b-q8/
gemma 3 27b vram 0 1 0% /ru/models/gemma3-27b-q4/
llama 3.3 vram requirements 0 1 0% /ru/models/llama33-70b-q8/
qwen 14b vram 0 1 0% /ru/models/qwen25-coder-14b-q8/
qwen 30b size 0 1 0% /ru/models/qwen3-coder-30b-q4/
qwen3-coder-30b 0 1 0% /ru/models/qwen3-coder-30b-cloud/
smollm2-135m 0 1 0% /ru/models/smollm2-135m-fp16/
vram 0 1 0% /ru/tools/vram-calculator/
vram stoker 0 1 0% /ru/tools/vram-calculator/
vram testi 0 1 0% /ru/tools/vram-calculator/