601
Total profiles
Compare 601 local LLM profiles by minimum VRAM, optimal VRAM, RTX 3090 speed, system RAM target, and whether the model is safe to run locally or better rented on cloud GPUs.
Start here if you are searching for "how much VRAM does this Ollama model need", "can it run on RTX 3090", or "which local LLM fits 24GB VRAM".
Ollama naming/source alignment date: 2026-02-24. Each profile links back to its Ollama library source.
Total profiles
Group hubs
Measured profiles
Estimated profiles
SC keywords recycled
Top curated models
| Rank | Model | Tag | VRAM Q4 | VRAM Q5 | System RAM | RTX 3090 fit | Category | Command |
|---|---|---|---|---|---|---|---|---|
| 1 | Qwen3 Coder | qwen3-coder:30b | 20GB | 22GB | 32GB+ | Comfortable | Coding | ollama run qwen3-coder:30b |
| 2 | Qwen3.6 | qwen3.6:35b | 22GB | 24GB | 32GB+ | Comfortable | Reasoning | ollama run qwen3.6:35b |
| 3 | Qwen3.5 | qwen3.5:35b | 22GB | 24GB | 32GB+ | Comfortable | Reasoning | ollama run qwen3.5:35b |
| 4 | GPT-OSS | gpt-oss:20b | 16GB | 20GB | 32GB+ | Comfortable | Reasoning | ollama run gpt-oss:20b |
| 6 | Gemma4 | gemma4:26b | 18GB | 22GB | 32GB+ | Comfortable | Multimodal / General | ollama run gemma4:26b |
| 7 | Llama 4 | llama4:16x17b | 40GB | 48GB | 64GB+ | Cloud / larger GPU | Multimodal / MoE | ollama run llama4:16x17b |
| 8 | Qwen3 | qwen3:32b | 20GB | 24GB | 32GB+ | Comfortable | Coding / Reasoning | ollama run qwen3:32b |
| 9 | Qwen3 | qwen3:14b | 12GB | 14GB | 32GB+ | Comfortable | Coding / Reasoning | ollama run qwen3:14b |
| 10 | Qwen3 | qwen3:8b | 8GB | 10GB | 16GB+ | Comfortable | Coding / Chat | ollama run qwen3:8b |
| 11 | Magistral | magistral:24b | 18GB | 22GB | 32GB+ | Comfortable | Reasoning | ollama run magistral:24b |
| 12 | Ministral 3 | ministral-3:14b | 12GB | 14GB | 32GB+ | Comfortable | Reasoning / Chat | ollama run ministral-3:14b |
| 13 | Nemotron 3 Nano | nemotron-3-nano:30b | 20GB | 24GB | 32GB+ | Comfortable | Reasoning / Chat | ollama run nemotron-3-nano:30b |
| 14 | Qwen3.5 | qwen3.5:122b | 70GB | 80GB | 128GB+ | Cloud / larger GPU | Reasoning / Large | ollama run qwen3.5:122b |
| 15 | Qwen3 Coder | qwen3-coder:480b | 215GB | 230GB | 128GB+ | Cloud / larger GPU | Coding / Large | ollama run qwen3-coder:480b |
| 16 | GPT-OSS | gpt-oss:120b | 70GB | 80GB | 128GB+ | Cloud / larger GPU | Reasoning / Large | ollama run gpt-oss:120b |
| 17 | Qwen3 VL | qwen3-vl:32b | 20GB | 24GB | 32GB+ | Comfortable | Multimodal / Vision | ollama run qwen3-vl:32b |
| 18 | Llama 3.3 | llama3.3:70b | 40GB | 48GB | 64GB+ | Cloud / larger GPU | General Chat | ollama run llama3.3:70b |
| 19 | DeepSeek-R1 | deepseek-r1:32b | 20GB | 24GB | 32GB+ | Comfortable | Reasoning / Math | ollama run deepseek-r1:32b |
| 20 | Gemma 3 | gemma3:12b | 12GB | 14GB | 32GB+ | Comfortable | Multimodal / General | ollama run gemma3:12b |
84 models
Open group507 models
Open group10 models
Open group224 models
Open group150 models
Open group14 models
Open group111 models
Open group102 models
Open group34 models
Open group72 models
Open group26 models
Open group120 models
Open group57 models
Open group60 models
Open group113 models
Open group119 models
Open group| Model | VRAM (min/optimal) | System RAM | RTX 3090 fit | 3090 tok/s | Path |
|---|---|---|---|---|---|
| Llama 4 128X17B Q4 | 418GB / 428GB | 128GB+ | Cloud / larger GPU | 1.1 | View |
| Llama 4 128X17B Q5 | 420GB / 430GB | 128GB+ | Cloud / larger GPU | 1 | View |
| Llama 4 128X17B Q8 | 424GB / 434GB | 128GB+ | Cloud / larger GPU | 0.8 | View |
| Llama 4 128X17B FP16 | 430GB / 442GB | 128GB+ | Cloud / larger GPU | 0.6 | View |
| DeepSeek-R1 671B Q4 | 418GB / 428GB | 128GB+ | Cloud / larger GPU | 1.1 | View |
| DeepSeek-R1 671B Q5 | 420GB / 430GB | 128GB+ | Cloud / larger GPU | 1 | View |
| DeepSeek-R1 671B Q8 | 424GB / 434GB | 128GB+ | Cloud / larger GPU | 0.8 | View |
| DeepSeek-R1 671B FP16 | 430GB / 442GB | 128GB+ | Cloud / larger GPU | 0.6 | View |
Top keywords feeding daily content and model page updates.
| Keyword | Clicks | Impressions | CTR | Landing |
|---|---|---|---|---|
| how much vram for llama 2 7b fp16 | 0 | 23 | 0% | /ar/models/llama2-7b-fp16/ |
| llama 2 7b fp16 vram requirement | 0 | 17 | 0% | /ar/models/llama2-7b-fp16/ |
| llama 2 7b fp16 vram requirements | 0 | 3 | 0% | /ar/models/llama2-7b-fp16/ |
| how much vram llama 2 7b fp16 | 0 | 2 | 0% | /ar/models/llama2-7b-fp16/ |
| qwen 1.8b | 0 | 2 | 0% | /ar/models/qwen-18b-q8/ |
| deepseek coder 6.7b | 0 | 1 | 0% | /ar/models/deepseek-coder-67b-q8/ |
| glm-4.7-flash vram | 0 | 1 | 0% | /ar/models/glm-47-flash-7b-q8/ |
| how much vram ram needed for llama 2 7b fp16 | 0 | 1 | 0% | /ar/models/llama2-7b-fp16/ |
| llama 2 7b fp16 vram requirement 16gb | 0 | 1 | 0% | /ar/models/llama2-7b-fp16/ |
| llama 3 70b vram requirements | 0 | 1 | 0% | /ar/models/llama3-70b-q8/ |
| qwen 14b vram | 0 | 1 | 0% | /ar/models/qwen25-coder-14b-q8/ |
| qwen 2.5 coder 14b requirements | 0 | 1 | 0% | /ar/models/qwen25-coder-14b-q8/ |
| qwen 3.5 35b vram | 0 | 1 | 0% | /ar/models/qwen35-35b-q8/ |
| qwen-1.8b | 0 | 1 | 0% | /ar/models/qwen-18b-q8/ |
| qwen2.5 coder 0.5b | 0 | 1 | 0% | /ar/models/qwen25-coder-05b-q8/ |
| qwen2.5:14b size | 0 | 1 | 0% | /ar/models/qwen25-coder-14b-q8/ |
| qwen2dvae | 0 | 1 | 0% | /ar/models/qwen25-72b-q8/ |
| qwen3 235b requirements | 0 | 1 | 0% | /ar/models/qwen3-235b-q8/ |
| qwen3 235b vram | 0 | 1 | 0% | /ar/models/qwen3-235b-q8/ |
| qwen3 4b fp16 | 0 | 1 | 0% | /ar/models/qwen3-4b-fp16/ |
| qwen3 vram | 0 | 1 | 0% | /ar/models/qwen3-4b-q8/ |
| vram | 0 | 13 | 0% | /de/tools/vram-calculator/ |
| conversion trichter | 0 | 10 | 0% | /de/status/conversion-funnel/ |
| vram | 0 | 5 | 0% | /de/ |
| v ram | 0 | 3 | 0% | /de/tools/vram-calculator/ |
| vram test | 0 | 3 | 0% | /de/tools/vram-calculator/ |
| qwen3-coder 30b q4 | 0 | 2 | 0% | /de/models/qwen3-coder-30b-q4/ |
| qwen3-coder-30b | 0 | 2 | 0% | /de/models/qwen3-coder-30b-q4/ |
| vram test | 0 | 2 | 0% | /de/ |
| cluster lokale gruppe | 0 | 1 | 0% | /de/guides/ollama-local-cluster-network/ |
| cluster lokale konten | 0 | 1 | 0% | /de/guides/ollama-local-cluster-network/ |
| how much vram does a 3090 have | 0 | 1 | 0% | /de/hardware/verified-3090/ |
| how much vram does the 3090 have | 0 | 1 | 0% | /de/hardware/verified-3090/ |
| qwen coder 30b | 0 | 1 | 0% | /de/models/qwen3-coder-30b-q4/ |
| qwen3 4b | 0 | 1 | 0% | /de/models/qwen3-4b-q8/ |
| qwen3 4b fp8 | 0 | 1 | 0% | /de/models/qwen3-4b-q8/ |
| qwen3 coder 30b | 0 | 1 | 0% | /de/models/qwen3-coder-30b-q4/ |
| vram. | 0 | 1 | 0% | /de/ |
| vram. | 0 | 1 | 0% | /de/tools/vram-calculator/ |
| ai83090 | 0 | 700 | 0% | /en/models/ |
| ai83090 | 0 | 50 | 0% | /en/updates/ |
| best rag models | 0 | 18 | 0% | /en/guides/best-rag-models/ |
| "search–space complexity" "performance–model acceleration" llama-2-7b rtx 3090 | 0 | 15 | 0% | /en/models/ |
| "search–space complexity" "performance–model acceleration" llama-2-7b rtx 3090 | 0 | 15 | 0% | /en/status/ |
| "search-space complexity" "performance-model acceleration" llama-2-7b rtx 3090 | 0 | 10 | 0% | /en/models/ |
| "search-space complexity" "performance-model acceleration" llama-2-7b rtx 3090 | 0 | 10 | 0% | /en/status/ |
| ai83090 | 0 | 7 | 0% | /en/hardware/verified-3090/ |
| best llm for 16gb vram | 0 | 4 | 0% | /en/blog/16gb-vram-model-selection-guide/ |
| deepseek r1 14b quantized vram requirement | 0 | 3 | 0% | /en/models/deepseek-r1-14b-q5/ |
| dual rtx 3090 70b q4 tokens per second llama.cpp benchmark | 0 | 3 | 0% | /en/models/llama-70b-q4/ |
| gemma3 latency use case | 0 | 3 | 0% | /en/blog/model-gemma3-27b-local-benchmark/ |
| best coding model 16gb vram | 0 | 2 | 0% | /en/guides/best-coding-models/ |
| best coding model for 24gb vram | 0 | 2 | 0% | /en/guides/best-coding-models/ |
| best local llms for 16gb vram | 0 | 2 | 0% | /en/blog/16gb-vram-model-selection-guide/ |
| best models for 24gb vram | 0 | 2 | 0% | /en/blog/best-24gb-vram-models-2026/ |
| gemma 2 27b vram requirements quantized | 0 | 2 | 0% | /en/models/ |
| how to check your vram | 0 | 2 | 0% | /en/tools/vram-calculator/ |
| llama 2 7b memory requirements | 0 | 2 | 0% | /en/models/ |
| locam.vx | 0 | 2 | 0% | /en/ |
| lovram | 0 | 2 | 0% | /en/ |
| my vram | 0 | 2 | 0% | /en/tools/vram-calculator/ |
| ollama model for 16gb ram | 0 | 2 | 0% | /en/models/ |
| best local llm for coding 2026 16gb vram | 1 | 1 | 100% | /en/guides/best-coding-models/ |
| "search–space complexity" "performance–model acceleration" "llama-2-7b" | 0 | 1 | 0% | /en/models/ |
| "search–space complexity" "performance–model acceleration" "llama-2-7b" | 0 | 1 | 0% | /en/status/ |
| 14b model vram | 0 | 1 | 0% | /en/models/ |
| 3090 fp8 | 0 | 1 | 0% | /en/hardware/verified-3090/ |
| 36gb vram | 0 | 1 | 0% | /en/tools/vram-calculator/ |
| ai83090 | 0 | 1 | 0% | /en/blog/ |
| best 12b coding model | 0 | 1 | 0% | /en/guides/best-coding-models/ |
| best 12b model | 0 | 1 | 0% | /en/guides/best-coding-models/ |
| best 12b model | 0 | 1 | 0% | /en/guides/best-rag-models/ |
| best 16gb vram model | 0 | 1 | 0% | /en/blog/16gb-vram-model-selection-guide/ |
| best 32b model for coding | 0 | 1 | 0% | /en/guides/best-coding-models/ |
| best coding llm for 16gb vram | 0 | 1 | 0% | /en/blog/16gb-vram-model-selection-guide/ |
| best coding model for 24gb vram | 0 | 1 | 0% | /en/blog/best-24gb-vram-models-2026/ |
| best coding model for 6gb vram | 0 | 1 | 0% | /en/guides/best-coding-models/ |
| best coding model for 8gb vram | 0 | 1 | 0% | /en/guides/best-coding-models/ |
| best coding models right now | 0 | 1 | 0% | /en/guides/best-coding-models/ |
| best fim model | 0 | 1 | 0% | /en/guides/best-coding-models/ |
| best llm 16gb vram | 0 | 1 | 0% | /en/blog/16gb-vram-model-selection-guide/ |
| best llm for rag | 0 | 1 | 0% | /en/guides/best-rag-models/ |
| best local ai model for 16gb vram | 0 | 1 | 0% | /en/blog/16gb-vram-model-selection-guide/ |
| best local coding model for 16gb vram | 0 | 1 | 0% | /en/blog/16gb-vram-model-selection-guide/ |
| best local llm 16gb vram | 0 | 1 | 0% | /en/blog/16gb-vram-model-selection-guide/ |
| best local llm for 16gb gpu | 0 | 1 | 0% | /en/blog/16gb-vram-model-selection-guide/ |
| best local llm for 16gb ram | 0 | 1 | 0% | /en/blog/16gb-vram-model-selection-guide/ |
| best local model for 16gb vram | 0 | 1 | 0% | /en/blog/16gb-vram-model-selection-guide/ |
| best local model for 24gb vram | 0 | 1 | 0% | /en/blog/best-24gb-vram-models-2026/ |
| best ollama model for 6gb vram | 0 | 1 | 0% | /en/models/ |
| best rag model | 0 | 1 | 0% | /en/guides/best-rag-models/ |
| best small llm for rag | 0 | 1 | 0% | /en/guides/best-rag-models/ |
| best small model for rag | 0 | 1 | 0% | /en/guides/best-rag-models/ |
| gemma 2 27b vram requirements | 0 | 1 | 0% | /en/models/ |
| gemma 2 27b vram requirements | 0 | 1 | 0% | /en/models/gemma2-27b-q5/ |
| gemma4 vram requirements | 0 | 1 | 0% | /en/models/gemma4-26b-q4/ |
| how much does it weight | 0 | 1 | 0% | /en/models/starcoder2-7b-q4/ |
| how much vram for gemma 4 | 0 | 1 | 0% | /en/models/gemma4-26b-q4/ |
| how to check how much vram you have | 0 | 1 | 0% | /en/tools/vram-calculator/ |
| how to check my vram | 0 | 1 | 0% | /en/tools/vram-calculator/ |
| llama 2 7b memory requirements fp16 ram vram size | 0 | 1 | 0% | /en/models/ |
| llm for 16gb vram | 0 | 1 | 0% | /en/blog/16gb-vram-model-selection-guide/ |
| local llm 16gb ram | 0 | 1 | 0% | /en/blog/16gb-vram-model-selection-guide/ |
| ollama cluster | 0 | 1 | 0% | /en/guides/ollama-local-cluster-network/ |
| ollama deepseek-coder-v2 16b size | 0 | 1 | 0% | /en/models/deepseek-coder-v2-16b-fp16/ |
| ollama deepseek-r1 14b size | 0 | 1 | 0% | /en/models/deepseek-r1-14b-q5/ |
| ollama deepseek-r1:14b model size | 0 | 1 | 0% | /en/models/deepseek-r1-14b-q5/ |
| ollama gemma 3 4b memory requirements | 0 | 1 | 0% | /en/models/ |
| ollama model for 8gb vram | 0 | 1 | 0% | /en/models/ |
| ollama model memory requirements 7b 14b 32b official | 0 | 1 | 0% | /en/models/ |
| ollama model vram requirements | 0 | 1 | 0% | /en/models/ |
| ollama models for 16gb ram | 0 | 1 | 0% | /en/models/ |
| ollama models for 16gb vram | 0 | 1 | 0% | /en/models/ |
| ollama models for 8gb vram | 0 | 1 | 0% | /en/models/ |
| ollama qwen2.5-coder 14b q4 size | 0 | 1 | 0% | /en/models/qwen25-coder-14b-q4/ |
| ollama qwen2.5-coder tags 7b size | 0 | 1 | 0% | /en/models/qwen25-coder-7b-q4/ |
| ollama qwen2.5-coder:14b size | 0 | 1 | 0% | /en/models/qwen25-coder-14b-fp16/ |
| ollama vram calculator | 0 | 1 | 0% | /en/models/ |
| q8 vs q4 quantization | 0 | 1 | 0% | /en/tools/quantization-blind-test/ |
| qwen2.5-coder 32b ollama vram requirements | 0 | 1 | 0% | /en/models/ |
| qwen2.5-coder model sizes vram requirements ollama | 0 | 1 | 0% | /en/models/ |
| qwen3 14b q4_k_m vram usage ollama | 0 | 1 | 0% | /en/models/ |
| qwen3 235b vram | 0 | 1 | 0% | /en/models/qwen3-4b-q5/ |
| qwen3 4b requirements | 0 | 1 | 0% | /en/models/qwen3-4b-q5/ |
| qwen3 vram | 0 | 1 | 0% | /en/models/qwen3-4b-q5/ |
| qwen3.6 35b a3b rtx 3090 tokens per second benchmark | 0 | 1 | 0% | /en/blog/daily-local-llm-benchmark-snapshot-2026-07-14/ |
| qwen_2.5_vl_7b_fp16 | 0 | 1 | 0% | /en/models/ |
| recommended quantized models for 8gb vram 2026 | 0 | 1 | 0% | /en/blog/best-24gb-vram-models-2026/ |
| rtx 4090 llm | 0 | 1 | 0% | /en/blog/rtx4090-vs-rtx3090-for-local-llm/ |
| vllm vs ollama | 0 | 1 | 0% | /en/guides/ollama-vs-vllm-vram/ |
| vram download | 0 | 1 | 0% | /en/tools/vram-calculator/ |
| vram needed for gemma 4 | 0 | 1 | 0% | /en/models/gemma4-26b-q4/ |
| vram tool | 0 | 1 | 0% | /en/tools/vram-calculator/ |
| vrm calculator | 0 | 1 | 0% | /en/tools/vram-calculator/ |
| what is my vram size | 0 | 1 | 0% | /en/tools/vram-calculator/ |
| лучшие модели для rag | 0 | 1 | 0% | /en/guides/best-rag-models/ |
| ai83090 | 0 | 100 | 0% | /es/status/ |
| ai83090 | 0 | 30 | 0% | /es/hardware/verified-3090/ |
| ai30790 | 0 | 9 | 0% | /es/hardware/verified-3090/ |
| llama 2 7b vram requirement fp16 | 0 | 6 | 0% | /es/models/llama2-7b-fp16/ |
| how much vram llama 2 7b fp16 | 0 | 5 | 0% | /es/models/llama2-7b-fp16/ |
| gpt oss 120b memory requirements | 0 | 4 | 0% | /es/models/gpt-oss-120b-q5/ |
| vram | 0 | 3 | 0% | /es/ |
| vram | 0 | 2 | 0% | /es/tools/vram-calculator/ |
| 671b | 0 | 1 | 0% | /es/models/deepseek-r1-671b-q8/ |
| cudamalloc failed: out of memory | 0 | 1 | 0% | /es/errors/cuda-out-of-memory/ |
| deepseek coder 6.7b | 0 | 1 | 0% | /es/models/deepseek-coder-67b-q8/ |
| gpt oss 120b how much vram | 0 | 1 | 0% | /es/models/gpt-oss-120b-q5/ |
| healthrun | 0 | 1 | 0% | /es/status/runner-health/ |
| how much vram for 120b model | 0 | 1 | 0% | /es/models/gpt-oss-120b-q5/ |
| llama 2 7b fp16 vram requirements | 0 | 1 | 0% | /es/models/llama2-7b-fp16/ |
| my vram | 0 | 1 | 0% | /es/ |
| my vram | 0 | 1 | 0% | /es/tools/vram-calculator/ |
| quantifying | 0 | 1 | 0% | /es/tools/quantization-blind-test/ |
| qwen 14b q4 | 0 | 1 | 0% | /es/models/qwen-14b-q4/ |
| qwen3.5 vit | 0 | 1 | 0% | /es/models/qwen3-17b-q5/ |
| rtx 3090 scan | 0 | 1 | 0% | /es/hardware/verified-3090/ |
| vllm vs ollama | 0 | 1 | 0% | /es/guides/ollama-vs-vllm-vram/ |
| vram como saber | 0 | 1 | 0% | /es/ |
| vrams | 0 | 1 | 0% | /es/ |
| vrams | 0 | 1 | 0% | /es/tools/vram-calculator/ |
| apple silicon llm | 0 | 7 | 0% | /fr/hardware/apple-silicon-llm-guide/ |
| cuda out of memory | 0 | 6 | 0% | /fr/errors/cuda-out-of-memory/ |
| hub multimodal | 0 | 6 | 0% | /fr/multimodal/ |
| matrice de compatibilité | 0 | 6 | 0% | /fr/matrix/ |
| entonnoir en anglais | 0 | 4 | 0% | /fr/status/conversion-funnel/ |
| ollama vs vllm | 0 | 3 | 0% | /fr/guides/ollama-vs-vllm-vram/ |
| vram | 0 | 3 | 0% | /fr/tools/vram-calculator/ |
| entonnoir anglais | 0 | 2 | 0% | /fr/status/conversion-funnel/ |
| localllama | 0 | 2 | 0% | /fr/blog/ |
| location gpu | 0 | 2 | 0% | /fr/affiliate/cloud-gpu/ |
| data freshness | 0 | 1 | 0% | /fr/status/data-freshness/ |
| deepseek coder 33b fp16 memory requirement | 0 | 1 | 0% | /fr/models/deepseek-coder-33b-fp16/ |
| deepseek coder 33b fp16 memory requirements | 0 | 1 | 0% | /fr/models/deepseek-coder-33b-fp16/ |
| llama 2 70b fp16 memory size gb | 0 | 1 | 0% | /fr/models/llama2-70b-fp16/ |
| qwen 32b vram requirements | 0 | 1 | 0% | /fr/models/qwen25-coder-32b-q4/ |
| qwen2.5-coder 32b q4_k_m | 0 | 1 | 0% | /fr/models/qwen25-coder-32b-q4/ |
| qwen3 4b int8 | 0 | 1 | 0% | /fr/models/qwen3-4b-q8/ |
| qwen3-coder-30b requirements | 0 | 1 | 0% | /fr/models/qwen3-coder-30b-q4/ |
| set vram | 0 | 1 | 0% | /fr/tools/vram-calculator/ |
| thry vram | 0 | 1 | 0% | /fr/models/ |
| vpngram | 0 | 1 | 0% | /fr/tools/vram-calculator/ |
| vram | 0 | 1 | 0% | /fr/ |
| vram cloud | 0 | 1 | 0% | /fr/affiliate/cloud-gpu/ |
| vram2 | 0 | 1 | 0% | /fr/guides/ollama-vs-vllm-vram/ |
| vram2 | 0 | 1 | 0% | /fr/tools/vram-calculator/ |
| deepseek r1 8b requirements | 0 | 1 | 0% | /hi/models/deepseek-r1-8b-q4/ |
| llama 3.3 vram requirements | 0 | 1 | 0% | /hi/models/llama33-70b-q8/ |
| qwen 12gb vram | 0 | 1 | 0% | /hi/models/qwen-72b-q4/ |
| qwen3 235b requirements | 0 | 2 | 0% | /id/models/qwen3-235b-q5/ |
| qwen3 32b q4 vram usage | 0 | 2 | 0% | /id/models/qwen3-32b-q4/ |
| good vram | 0 | 1 | 0% | /id/tools/vram-calculator/ |
| gpt oss 120b memory requirements | 0 | 1 | 0% | /id/models/gpt-oss-120b-q5/ |
| how much vram llama 2 70b fp16 | 0 | 1 | 0% | /id/models/llama2-70b-fp16/ |
| how much vram needed for llama 2 70b fp16 | 0 | 1 | 0% | /id/models/llama2-70b-fp16/ |
| llama 2 70b fp16 memory size | 0 | 1 | 0% | /id/models/llama2-70b-fp16/ |
| llama 2 70b fp16 memory size gb | 0 | 1 | 0% | /id/models/llama2-70b-fp16/ |
| llama 2 70b memory requirements fp16 | 0 | 1 | 0% | /id/models/llama2-70b-fp16/ |
| llama 2 70b parameters memory fp16 size | 0 | 1 | 0% | /id/models/llama2-70b-fp16/ |
| llama 3.3 70b vram requirements | 0 | 1 | 0% | /id/models/llama3-70b-q4/ |
| lowvram | 0 | 1 | 0% | /id/ |
| ollama qwen2.5 14b model size official | 0 | 1 | 0% | /id/models/qwen25-coder-14b-q5/ |
| qwen3 235b a22b hardware requirements | 0 | 1 | 0% | /id/models/qwen3-235b-q5/ |
| reserve vram | 0 | 1 | 0% | /id/tools/vram-calculator/ |
| データ 鮮度 | 0 | 9 | 0% | /ja/status/data-freshness/ |
| データ鮮度 | 0 | 5 | 0% | /ja/status/data-freshness/ |
| ブラインドテスト | 0 | 4 | 0% | /ja/tools/quantization-blind-test/ |
| cuda out of memory | 0 | 3 | 0% | /ja/errors/cuda-out-of-memory/ |
| mixtral 8x7b vram requirements | 0 | 2 | 0% | /ja/models/mixtral-8x7b-q4/ |
| cuda error out of memory | 0 | 1 | 0% | /ja/errors/cuda-out-of-memory/ |
| data freshness | 0 | 1 | 0% | /ja/status/data-freshness/ |
| mixtral 8x7b 4-bit vram requirement | 0 | 1 | 0% | /ja/models/mixtral-8x7b-q4/ |
| ollama cluster | 0 | 1 | 0% | /ja/blog/ollama-local-cluster-network-checklist/ |
| qwen 2.5 coder 7b system requirements | 0 | 1 | 0% | /ja/models/qwen25-coder-7b-fp16/ |
| コンバージョンファネルとは | 0 | 1 | 0% | /ja/status/conversion-funnel/ |
| ai83090 | 0 | 52 | 0% | /ko/blog/ |
| 데이터 신선도 | 0 | 39 | 0% | /ko/status/data-freshness/ |
| 3090 vram | 0 | 30 | 0% | /ko/blog/still-the-vram-king-rtx-3090-2026/ |
| rtx 3090 vram | 0 | 6 | 0% | /ko/blog/still-the-vram-king-rtx-3090-2026/ |
| qwen3 4b q4 | 0 | 3 | 0% | /ko/models/qwen3-4b-q4/ |
| 3090vram | 0 | 2 | 0% | /ko/hardware/verified-3090/ |
| qwen-1.8b | 0 | 2 | 0% | /ko/models/qwen-18b-fp16/ |
| qwen3 8b q4 | 0 | 2 | 0% | /ko/models/qwen3-8b-q4/ |
| 3090 vram | 0 | 1 | 0% | /ko/hardware/verified-3090/ |
| 36gb vram | 0 | 1 | 0% | /ko/hardware/ |
| 70b q4 | 0 | 1 | 0% | /ko/models/codellama-70b-q4/ |
| gemma 3 4b | 0 | 1 | 0% | /ko/models/gemma3-4b-q4/ |
| gemma 3-4b | 0 | 1 | 0% | /ko/models/gemma3-4b-q4/ |
| gemma3 12b | 0 | 1 | 0% | /ko/models/gemma3-12b-fp16/ |
| gemma3-12b | 0 | 1 | 0% | /ko/models/gemma3-12b-fp16/ |
| gemma4 e2b q4 | 0 | 1 | 0% | /ko/models/gemma4-e2b-q4/ |
| how much vram does a 3090 have | 0 | 1 | 0% | /ko/hardware/verified-3090/ |
| how much vram does the 3090 have | 0 | 1 | 0% | /ko/hardware/verified-3090/ |
| llama 3.3 70b | 0 | 1 | 0% | /ko/models/llama33-70b-q4/ |
| llama 3.3 70b | 0 | 1 | 0% | /ko/models/llama33-70b-q5/ |
| local llm 16gb vram | 0 | 1 | 0% | /ko/blog/16gb-vram-model-selection-guide/ |
| minicpm-v 8b | 0 | 1 | 0% | /ko/models/minicpm-v-8b-q8/ |
| nvidia 3090 vram | 0 | 1 | 0% | /ko/blog/still-the-vram-king-rtx-3090-2026/ |
| phi4:14b | 0 | 1 | 0% | /ko/models/phi4-reasoning-14b-q4/ |
| qwen 1.8b | 0 | 1 | 0% | /ko/models/qwen-18b-fp16/ |
| qwen 32b | 0 | 1 | 0% | /ko/models/qwen-32b-q8/ |
| qwen 4 4b | 0 | 1 | 0% | /ko/models/qwen-4b-q4/ |
| qwen fp16 | 0 | 1 | 0% | /ko/models/qwen-18b-fp16/ |
| qwen-32b | 0 | 1 | 0% | /ko/models/qwen-32b-q8/ |
| qwen/qwen3-8b-fp8 | 0 | 1 | 0% | /ko/models/qwen3-8b-q8/ |
| qwen2 5 coder 7b | 0 | 1 | 0% | /ko/models/qwen25-coder-7b-q4/ |
| qwen3 vl 8b | 0 | 1 | 0% | /ko/models/qwen3-vl-8b-cloud/ |
| qwen3 vl 8b | 0 | 1 | 0% | /ko/models/qwen3-vl-8b-fp16/ |
| qwen3-vl-8b | 0 | 1 | 0% | /ko/models/qwen3-vl-8b-cloud/ |
| qwen3-vl-8b | 0 | 1 | 0% | /ko/models/qwen3-vl-8b-fp16/ |
| rtx 3090 vram | 0 | 1 | 0% | /ko/hardware/verified-3090/ |
| site:ollama.com/library/qwen3-coder 30b ollama | 0 | 1 | 0% | /ko/models/group/30b-34b/ |
| vram 16gb llm | 0 | 1 | 0% | /ko/blog/16gb-vram-model-selection-guide/ |
| vram rtx 3090 | 0 | 1 | 0% | /ko/hardware/verified-3090/ |
| vram | 0 | 4 | 0% | /pt/tools/vram-calculator/ |
| gpt oss 120b memory requirements | 0 | 3 | 0% | /pt/models/gpt-oss-120b-q5/ |
| vram | 0 | 2 | 0% | /pt/ |
| 14b q4 | 0 | 1 | 0% | /pt/models/qwen3-14b-q4/ |
| deepseek coder 33b fp16 vram requirement | 0 | 1 | 0% | /pt/models/deepseek-coder-33b-fp16/ |
| gpt oss 120b ram requirements | 0 | 1 | 0% | /pt/models/gpt-oss-120b-q5/ |
| localllama | 0 | 1 | 0% | /pt/blog/ |
| mixtral 8x7b 4-bit vram requirement | 0 | 1 | 0% | /pt/models/mixtral-8x7b-q5/ |
| ollama run qwen2.5:0.5b | 0 | 1 | 0% | /pt/models/qwen25-05b-fp16/ |
| qwen3 14b q4 vram usage | 0 | 1 | 0% | /pt/models/qwen3-14b-q4/ |
| qwen3 vram | 0 | 1 | 0% | /pt/models/qwen3-17b-fp16/ |
| vram como ver | 0 | 1 | 0% | /pt/ |
| vram como ver | 0 | 1 | 0% | /pt/tools/vram-calculator/ |
| ai83090 | 0 | 6 | 0% | /ru/hardware/verified-3090/ |
| rtx 3090 2026 | 1 | 1 | 100% | /ru/blog/still-the-vram-king-rtx-3090-2026/ |
| 1024mb vram | 0 | 1 | 0% | /ru/tools/vram-calculator/ |
| 30b model vram requirements | 0 | 1 | 0% | /ru/models/qwen3-coder-30b-q4/ |
| ai30908 | 0 | 1 | 0% | /ru/hardware/verified-3090/ |
| cuda error out of memory | 0 | 1 | 0% | /ru/errors/cuda-out-of-memory/ |
| cuda out of memory | 0 | 1 | 0% | /ru/errors/cuda-out-of-memory/ |
| cuda out of memory. | 0 | 1 | 0% | /ru/errors/cuda-out-of-memory/ |
| deepseek coder 6.7b | 0 | 1 | 0% | /ru/models/deepseek-coder-67b-q8/ |
| gemma 3 27b vram | 0 | 1 | 0% | /ru/models/gemma3-27b-q4/ |
| llama 3.3 vram requirements | 0 | 1 | 0% | /ru/models/llama33-70b-q8/ |
| qwen 14b vram | 0 | 1 | 0% | /ru/models/qwen25-coder-14b-q8/ |
| qwen 30b size | 0 | 1 | 0% | /ru/models/qwen3-coder-30b-q4/ |
| qwen3-coder-30b | 0 | 1 | 0% | /ru/models/qwen3-coder-30b-cloud/ |
| smollm2-135m | 0 | 1 | 0% | /ru/models/smollm2-135m-fp16/ |
| vram | 0 | 1 | 0% | /ru/tools/vram-calculator/ |
| vram stoker | 0 | 1 | 0% | /ru/tools/vram-calculator/ |
| vram testi | 0 | 1 | 0% | /ru/tools/vram-calculator/ |