Llama 3.3
O Llama 3.3 só existe em 70B: download real no Ollama, VRAM calculada, a licença da Meta explicada e quando a nuvem é o único caminho realista.
Qwen 3
Do 0.6b que roda em qualquer máquina ao 235b: download real de cada Qwen 3 no Ollama, VRAM calculada e quando compensa alugar GPU em vez de comprar.
DeepSeek R1
Quanto precisa para rodar o DeepSeek R1 local: download real de cada versão no Ollama, VRAM calculada, e quando compensa GPU na nuvem em vez de placa.








