Guia prático

IA grátis para usar localmente

A execução local pode reduzir o envio de dados a terceiros e dispensar cotas de um serviço hospedado. O custo de hardware e energia continua existindo; alguns recursos exigem internet, conta ou API externa. Confira as configurações antes de trabalhar com documentos confidenciais.

Modelos de IA local ainda são limitados e podem estar desatualizados em relação aos modelos de nuvem. Evite usá-los para decisões sobre saúde, finanças, questões jurídicas ou outros assuntos sensíveis — para esses casos, prefira fontes confiáveis ou profissionais qualificados.

Opções para começar

IA local / self-hosted

Ollama

Servidor e ferramenta de linha de comando para rodar LLMs e modelos multimodais no seu próprio computador com API compatível com a OpenAI.

Grátis: O software pode ser executado localmente sem assinatura. O uso depende de hardware, energia e da licença de…

Open source / localPT
IA local / self-hosted

LM Studio

Ambiente visual para baixar, testar e conversar com modelos GGUF locais no Windows, Mac e Linux com servidor local de 1 clique.

Grátis: O aplicativo permite executar modelos compatíveis localmente. Hardware, licença de cada modelo e eventuais…

Open source / localPT
IA local / self-hosted

Jan

Aplicativo de chat para executar modelos compatíveis no próprio computador.

Grátis: O aplicativo é aberto e pode ser usado localmente sem assinatura. Hardware, modelos e serviços externos con…

Open source / localPT
Famílias de modelos abertos

Llama

Família de LLMs open-weight da Meta (Llama 3.x / 4): roda localmente via Ollama/LM Studio ou em provedores de nuvem.

Grátis: Pesos de variantes podem ser baixados para execução própria conforme licença e hardware. A Meta AI é outro…

Open source / localPT
Famílias de modelos abertos

Gemma

Família de modelos do Google com variantes disponíveis para execução local.

Grátis: Pesos de variantes publicadas podem ser baixados para execução própria. Confira a licença do modelo escolhi…

Open source / localPT
Famílias de modelos abertos

Mistral

Família open-weight da Mistral AI (Mistral Small/Nemo, Mixtral, Codestral…): ótima relação qualidade × tamanho para rodar localmente.

Grátis: Variantes com pesos publicados podem rodar localmente conforme licença e hardware. O chat Le Chat é um prod…

Open source / localPT
Famílias de modelos abertos

Phi

Família de SLMs da Microsoft (Phi-3 / Phi-4): modelos pequenos e capazes para CPU/GPU modesta, com pesos no Hugging Face e Azure.

Grátis: Pesos de variantes publicadas podem ser usados em execução própria conforme licença. Serviços Azure têm cus…

Open source / localPT
Chatbots e assistentes

DeepSeek

Assistente de chat e família de modelos publicados pela DeepSeek para texto, raciocínio e código.

Grátis: O chat web oferece acesso gratuito sujeito a limites. Variantes com pesos publicados podem rodar localmente…

FreemiumPT
Chatbots e assistentes

Qwen

Família de modelos da Alibaba com chat web e variantes que podem ser executadas localmente.

Grátis: O chat e algumas variantes abertas oferecem caminhos de uso gratuito. Agentes, API e serviços hospedados tê…

GrátisPT
Transcrição, TTS e tradução

Whisper

Modelo de reconhecimento de fala para transcrição multilíngue e tradução de fala para inglês.

Grátis: Código e pesos sob licença MIT; pode rodar localmente ou em infraestrutura própria. Consulte o site oficial…

Open source / localPT
Geração de imagem

Stable Diffusion

Família de modelos de geração de imagens com variantes usadas em ferramentas locais e serviços.

Grátis: Pesos de variantes disponíveis e serviços de inferência. Consulte o site oficial para os limites gratuitos…

Open source / localPT
Geração de imagem

FLUX

Família de modelos de geração de imagens com variantes e licenças diferentes.

Grátis: Algumas variantes podem ser executadas localmente sem custo de licença. Confira a licença da variante escol…

Open source / localPT

Quanto de memória (RAM e VRAM) você precisa?

O requisito depende do modelo, da quantização, do tamanho do contexto e dos outros programas abertos. Confira a documentação da variante escolhida e comece por um modelo pequeno.

Antes de baixar um modelo

  • Espaço no SSD guarda o arquivo; RAM e VRAM são recursos de execução.
  • Veja o tamanho do arquivo e a memória recomendada na página do modelo.
  • Confira licença, origem do download e compatibilidade com o aplicativo.
📖 Ler Guia Técnico Completo de Hardware e Modelos GGUF ➔

IA local sem placa de vídeo ou em PC fraco

Computador sem placa de vídeo dedicada ou com pouca memória ainda pode rodar IA, desde que você escolha modelos pequenos e aceite respostas mais lentas. Comece por LM Studio, Jan ou Ollama e teste uma variante pequena antes de subir de tamanho.

Dá para rodar IA no computador sem placa de vídeo?

Sim, em muitos casos. Programas como Ollama, LM Studio e Jan conseguem executar modelos pequenos usando só o processador (CPU) e a memória RAM. A resposta tende a ser mais lenta do que com placa de vídeo, e modelos grandes podem ficar impraticáveis.

Qual IA local usar em um PC fraco?

Comece por modelos pequenos e quantizados, como as variantes menores das famílias Phi, Gemma e Qwen, e confira na página de cada modelo o tamanho do arquivo e a memória recomendada. Aumente o tamanho só se o computador responder bem.

Preciso de muita memória RAM para rodar IA local?

Depende do modelo, da quantização e do tamanho do contexto. Não existe um requisito único: quanto menor o modelo, menos memória ele pede. Feche outros programas e reduza o contexto se o sistema travar.

Rodar IA localmente é grátis?

Os programas e muitos modelos não têm assinatura, mas hardware, armazenamento e energia têm custo. Confira também a licença de cada modelo.

Como escolher

Para chat visual imediato e testes de modelos GGUF, escolha o LM Studio ou Jan. Para automações, terminal e endpoints locais de desenvolvimento, prefira o Ollama. Para áudio offline, use Whisper; para imagens, Stable Diffusion ou FLUX.

Para ver o catálogo completo com mais opções e filtros, confira a categoria IA local / self-hosted.

Os planos e limites podem mudar. Abra a ficha de cada ferramenta e confirme a oferta atual no site oficial antes de depender dela para um projeto.

Instale primeiro um fluxo pequeno

Confira sistema, memória, espaço em disco e licença do modelo. Comece por uma variante compatível com o hardware, registre quantização e contexto e monitore memória e tempo até a primeira resposta. Depois do download, verifique o modo offline e as conexões das extensões.

Siga o passo a passo de IA no computador. Interface visual e terminal são escolhas de fluxo, não garantia de qualidade de modelo. Para decidir entre os aplicativos, consulte Ollama vs LM Studio.

Roteiro editorial atualizado em . Não é um relatório de testes executados.