Guia prático
IA grátis para usar localmente
A execução local pode reduzir o envio de dados a terceiros e dispensar cotas de um serviço hospedado. O custo de hardware e energia continua existindo; alguns recursos exigem internet, conta ou API externa. Confira as configurações antes de trabalhar com documentos confidenciais.
Modelos de IA local ainda são limitados e podem estar desatualizados em relação aos modelos de nuvem. Evite usá-los para decisões sobre saúde, finanças, questões jurídicas ou outros assuntos sensíveis — para esses casos, prefira fontes confiáveis ou profissionais qualificados.
Opções para começar
Ollama
Servidor e ferramenta de linha de comando para rodar LLMs e modelos multimodais no seu próprio computador com API compatível com a OpenAI.
Grátis: O software pode ser executado localmente sem assinatura. O uso depende de hardware, energia e da licença de…
IA local / self-hostedLM Studio
Ambiente visual para baixar, testar e conversar com modelos GGUF locais no Windows, Mac e Linux com servidor local de 1 clique.
Grátis: O aplicativo permite executar modelos compatíveis localmente. Hardware, licença de cada modelo e eventuais…
IA local / self-hostedJan
Aplicativo de chat para executar modelos compatíveis no próprio computador.
Grátis: O aplicativo é aberto e pode ser usado localmente sem assinatura. Hardware, modelos e serviços externos con…
Famílias de modelos abertosLlama
Família de LLMs open-weight da Meta (Llama 3.x / 4): roda localmente via Ollama/LM Studio ou em provedores de nuvem.
Grátis: Pesos de variantes podem ser baixados para execução própria conforme licença e hardware. A Meta AI é outro…
Famílias de modelos abertosGemma
Família de modelos do Google com variantes disponíveis para execução local.
Grátis: Pesos de variantes publicadas podem ser baixados para execução própria. Confira a licença do modelo escolhi…
Famílias de modelos abertosMistral
Família open-weight da Mistral AI (Mistral Small/Nemo, Mixtral, Codestral…): ótima relação qualidade × tamanho para rodar localmente.
Grátis: Variantes com pesos publicados podem rodar localmente conforme licença e hardware. O chat Le Chat é um prod…
Famílias de modelos abertosPhi
Família de SLMs da Microsoft (Phi-3 / Phi-4): modelos pequenos e capazes para CPU/GPU modesta, com pesos no Hugging Face e Azure.
Grátis: Pesos de variantes publicadas podem ser usados em execução própria conforme licença. Serviços Azure têm cus…
Chatbots e assistentesDeepSeek
Assistente de chat e família de modelos publicados pela DeepSeek para texto, raciocínio e código.
Grátis: O chat web oferece acesso gratuito sujeito a limites. Variantes com pesos publicados podem rodar localmente…
Chatbots e assistentesQwen
Família de modelos da Alibaba com chat web e variantes que podem ser executadas localmente.
Grátis: O chat e algumas variantes abertas oferecem caminhos de uso gratuito. Agentes, API e serviços hospedados tê…
Transcrição, TTS e traduçãoWhisper
Modelo de reconhecimento de fala para transcrição multilíngue e tradução de fala para inglês.
Grátis: Código e pesos sob licença MIT; pode rodar localmente ou em infraestrutura própria. Consulte o site oficial…
Geração de imagemStable Diffusion
Família de modelos de geração de imagens com variantes usadas em ferramentas locais e serviços.
Grátis: Pesos de variantes disponíveis e serviços de inferência. Consulte o site oficial para os limites gratuitos…
Geração de imagemFLUX
Família de modelos de geração de imagens com variantes e licenças diferentes.
Grátis: Algumas variantes podem ser executadas localmente sem custo de licença. Confira a licença da variante escol…
Quanto de memória (RAM e VRAM) você precisa?
O requisito depende do modelo, da quantização, do tamanho do contexto e dos outros programas abertos. Confira a documentação da variante escolhida e comece por um modelo pequeno.
Antes de baixar um modelo
- Espaço no SSD guarda o arquivo; RAM e VRAM são recursos de execução.
- Veja o tamanho do arquivo e a memória recomendada na página do modelo.
- Confira licença, origem do download e compatibilidade com o aplicativo.
IA local sem placa de vídeo ou em PC fraco
Computador sem placa de vídeo dedicada ou com pouca memória ainda pode rodar IA, desde que você escolha modelos pequenos e aceite respostas mais lentas. Comece por LM Studio, Jan ou Ollama e teste uma variante pequena antes de subir de tamanho.
Dá para rodar IA no computador sem placa de vídeo?
Sim, em muitos casos. Programas como Ollama, LM Studio e Jan conseguem executar modelos pequenos usando só o processador (CPU) e a memória RAM. A resposta tende a ser mais lenta do que com placa de vídeo, e modelos grandes podem ficar impraticáveis.
Qual IA local usar em um PC fraco?
Comece por modelos pequenos e quantizados, como as variantes menores das famílias Phi, Gemma e Qwen, e confira na página de cada modelo o tamanho do arquivo e a memória recomendada. Aumente o tamanho só se o computador responder bem.
Preciso de muita memória RAM para rodar IA local?
Depende do modelo, da quantização e do tamanho do contexto. Não existe um requisito único: quanto menor o modelo, menos memória ele pede. Feche outros programas e reduza o contexto se o sistema travar.
Rodar IA localmente é grátis?
Os programas e muitos modelos não têm assinatura, mas hardware, armazenamento e energia têm custo. Confira também a licença de cada modelo.
Como escolher
Para chat visual imediato e testes de modelos GGUF, escolha o LM Studio ou Jan. Para automações, terminal e endpoints locais de desenvolvimento, prefira o Ollama. Para áudio offline, use Whisper; para imagens, Stable Diffusion ou FLUX.
Para ver o catálogo completo com mais opções e filtros, confira a categoria IA local / self-hosted.
Os planos e limites podem mudar. Abra a ficha de cada ferramenta e confirme a oferta atual no site oficial antes de depender dela para um projeto.
Instale primeiro um fluxo pequeno
Confira sistema, memória, espaço em disco e licença do modelo. Comece por uma variante compatível com o hardware, registre quantização e contexto e monitore memória e tempo até a primeira resposta. Depois do download, verifique o modo offline e as conexões das extensões.
Siga o passo a passo de IA no computador. Interface visual e terminal são escolhas de fluxo, não garantia de qualidade de modelo. Para decidir entre os aplicativos, consulte Ollama vs LM Studio.
Roteiro editorial atualizado em . Não é um relatório de testes executados.
