Modelos de linguagem e de imagem rodando no seu computador: sem mensalidade por uso e sem que prontuário, projeto ou código-fonte saia da máquina.
O que define o tamanho do modelo é a memória da placa de vídeo. A categoria reúne as 160 máquinas do catálogo com placa NVIDIA RTX de 12 GB ou mais e pelo menos 32 GB de RAM, e os Apple com 24 GB ou mais de memória unificada.
Fora da categoria. Rodam modelos pequenos, mas o limite chega cedo.
Modelos de linguagem de até uns 14 bilhões de parâmetros inteiros na placa. Assistente de código, transcrição de áudio e geração de imagem.
Modelos de linguagem de até uns 20 bilhões de parâmetros inteiros na placa, com resposta rápida. Geração de imagem em alta resolução.
Modelos de linguagem na casa dos 30 bilhões de parâmetros inteiros na placa, e geração de imagem e vídeo sem aperto.
No chip M a placa de vídeo usa a mesma memória do sistema: com 24 GB ou mais, modelos médios rodam em silêncio e com pouco consumo.
MacBookMacBook Pro 16″ M5 Max
MacBookMacBook Pro 16″ M5 Max
NotebookGigabyte AORUS MASTER 16
WorkstationRyzen 7 9800X3D com RTX 5070 Ti
WorkstationCore i7 14700KF com RTX 5070 Ti
WorkstationCore Ultra 5 245KF com RTX 5080
WorkstationRyzen 9 9950X3D com RTX 5080
DesktopCore i7 14700KF com RTX 5070
WorkstationRyzen 9 9950X3D com RTX 5070
WorkstationCore i5 14600KF com RTX 5070 Ti
WorkstationRyzen 9 9900X3D com RTX 5080
WorkstationRyzen 9 9950X3D com RTX 5080
MacBookMacBook Pro 16″ M5 Pro
WorkstationRyzen 9 9900X3D com RTX 5070
MacBookMacBook Pro 14″ M5 Pro
WorkstationCore Ultra 5 245KF com RTX 5070 Ti
DesktopRyzen 7 9800X3D com RTX 5070
WorkstationRyzen 9 9950X3D com RTX 5070 Ti
WorkstationRyzen 9 9900X3D com RTX 5080
WorkstationRyzen 9 9950X3D com RTX 5060 Ti
DesktopCore i7 14700KF com RTX 5070
WorkstationRyzen 7 9800X3D com RTX 5080
WorkstationRyzen 9 9900X3D com RTX 5070 Ti
DesktopCore i5 14600KF com RTX 5070 TiPreços do catálogo do site. A disponibilidade é confirmada no atendimento.
Os tamanhos de modelo desta página valem para modelos comprimidos em 4 bits, o formato mais usado em programas como Ollama e LM Studio. É uma ordem de grandeza: o tamanho da conversa também ocupa memória.
Porque o modelo é carregado na memória da placa de vídeo e é ela que faz a conta. Quando o modelo não cabe inteiro, uma parte vai para a RAM e a resposta fica bem mais lenta. Por isso a categoria é organizada pela memória da placa.
Só para baixar o modelo e os programas. Depois de baixado, ele roda na máquina: o que você escreve ou envia para análise não sai do computador.
As ferramentas de IA local são feitas primeiro para NVIDIA, e nelas tudo funciona sem ajuste. Placas Radeon também rodam modelos, mas pedem configuração a mais. Se você prefere uma, fale com a loja.
No chip M a memória é unificada: a placa de vídeo usa a mesma memória do sistema. Por isso entram na categoria os Apple com 24 GB ou mais.
A RAM é onde o modelo passa antes de ir para a placa, e é para onde vai o que não coube nela. Com menos que isso, a máquina trava justamente quando o modelo é grande.
Entre as máquinas prontas do catálogo, hoje a maior placa tem 16 GB. Para uma configuração com placa maior, fale com a loja pelo WhatsApp.