2

É que depende de quanto de VRAM ta liberado. o padrão do vast.ai é 24gb, o que já da para fazer bastante coisa. E para rodar só precisa do software como um ollama para texto, whisper, etc.

Se você tiver em casa uma 4070 de 16gb-24gb. e 16gb de ram na cpu. Acredito que consiga rodar alguns llms auxiliares, não sei qual modelo agora ajuda, mas já vi rodarem: https://x.com/analogalok/status/2092697021790708148
"The VRAM barrier is officially dead.

I just ran Qwen 3.8 Flash Next (MoE) 125B A6B with a 250,000 context window on a single 24GB RTX 4090.

21 tokens/sec decode. 364 t/s prefill. "

Depende e depende, recomendaria jogar na IA, se ela te responder corretamente ou fizer testes, me informe aqui, adoraria saber se conseguiu. Eu mesmo ainda não tenho nem uma placa de vídeo.

Carregando publicação patrocinada...