Modelos de linguagem e de imagem rodando no seu computador: sem mensalidade por uso e sem que prontuário, projeto ou código-fonte saia da máquina.
O que define o tamanho do modelo é a memória da placa de vídeo. A categoria reúne as 167 máquinas do catálogo com placa NVIDIA RTX de 12 GB ou mais e pelo menos 32 GB de RAM, e os Apple com 24 GB ou mais de memória unificada.
Fora da categoria. Rodam modelos pequenos, mas o limite chega cedo.
Modelos de linguagem de até uns 14 bilhões de parâmetros inteiros na placa. Assistente de código, transcrição de áudio e geração de imagem.
Modelos de linguagem de até uns 20 bilhões de parâmetros inteiros na placa, com resposta rápida. Geração de imagem em alta resolução.
Modelos de linguagem na casa dos 30 bilhões de parâmetros inteiros na placa, e geração de imagem e vídeo sem aperto.
No chip M a placa de vídeo usa a mesma memória do sistema: com 24 GB ou mais, modelos médios rodam em silêncio e com pouco consumo.
DesktopCore i7 14700KF com RTX 5070
WorkstationRyzen 9 9950X3D com RTX 5070
WorkstationRyzen 9 9900X3D com RTX 5070
DesktopRyzen 7 9800X3D com RTX 5070
DesktopCore i7 14700KF com RTX 5070
WorkstationRyzen 7 9800X3D com RTX 5070
DesktopRyzen 7 9700X com RTX 5070
WorkstationCore Ultra 5 245KF com RTX 5070
WorkstationRyzen 9 9950X3D com RTX 5070
WorkstationRyzen 9 9900X3D com RTX 5070
WorkstationRyzen 9 9950X3D com RTX 5070
WorkstationRyzen 9 9900X3D com RTX 5070
DesktopRyzen 7 9800X3D com RTX 4070 Super
WorkstationRyzen 7 9800X3D com RTX 5070
DesktopCore i5 14600KF com RTX 5070
WorkstationRyzen 7 9800X3D com RTX 5070
DesktopCore i5 14600KF com RTX 5070
WorkstationCore Ultra 5 245KF com RTX 5070
WorkstationCore Ultra 5 245KF com RTX 5070
DesktopCore i9 10900F com RTX 3060
DesktopCore i7 12700KF com RTX 5070
DesktopCore i7 12700KF com RTX 5070
DesktopCore i7 12700KF com RTX 5070
DesktopCore i7 12700KF com RTX 5070Preços do catálogo do site. A disponibilidade é confirmada no atendimento.
Os tamanhos de modelo desta página valem para modelos comprimidos em 4 bits, o formato mais usado em programas como Ollama e LM Studio. É uma ordem de grandeza: o tamanho da conversa também ocupa memória.
Porque o modelo é carregado na memória da placa de vídeo e é ela que faz a conta. Quando o modelo não cabe inteiro, uma parte vai para a RAM e a resposta fica bem mais lenta. Por isso a categoria é organizada pela memória da placa.
Só para baixar o modelo e os programas. Depois de baixado, ele roda na máquina: o que você escreve ou envia para análise não sai do computador.
As ferramentas de IA local são feitas primeiro para NVIDIA, e nelas tudo funciona sem ajuste. Placas Radeon também rodam modelos, mas pedem configuração a mais. Se você prefere uma, fale com a loja.
No chip M a memória é unificada: a placa de vídeo usa a mesma memória do sistema. Por isso entram na categoria os Apple com 24 GB ou mais.
A RAM é onde o modelo passa antes de ir para a placa, e é para onde vai o que não coube nela. Com menos que isso, a máquina trava justamente quando o modelo é grande.
Entre as máquinas prontas do catálogo, hoje a maior placa tem 16 GB. Para uma configuração com placa maior, fale com a loja pelo WhatsApp.