Código aberto e pesos abertos
IA local, software aberto e modelos com pesos publicados
Aplicativos locais e modelos com pesos publicados permitem formas de execução própria. Cada projeto tem licença e requisitos distintos; execução local não significa código aberto.
Aqui você encontra aplicativos e modelos para baixar ou executar no seu ambiente. Confira o que pode ser auditado, modificado ou usado comercialmente em cada licença.
Modelos de IA local ainda são limitados e podem estar desatualizados em relação aos modelos de nuvem. Evite usá-los para decisões sobre saúde, finanças, questões jurídicas ou outros assuntos sensíveis — para esses casos, prefira fontes confiáveis ou profissionais qualificados.
Por que considerar execução própria?
1. Controle de dados: a execução própria pode reduzir o envio a
terceiros, se não houver integrações externas.
2. Controle da capacidade:
você administra os recursos, sujeito ao hardware e ao custo de operação.
3. Uso offline:
alguns fluxos funcionam sem internet depois de baixar os arquivos necessários.
Ferramentas locais e modelos catalogados (27)
Aider
Assistente de programação em pares no terminal, open source, que edita o código do projeto com Git integrado.
Grátis: O software é gratuito e open source (Apache 2.0); o custo depende do modelo, que pode ser local ou uma API de…
IDEs e assistentes de códigoCline
Agente de código open source (Apache 2.0) para VS Code e terminal: edita o projeto, roda comandos e aceita Ollama ou qualquer API (BYOK).
Grátis: O software é aberto e pode ser usado sem assinatura própria. Modelos locais dependem do hardware; provedore…
Automação e agentesCrewAI
Framework open-source para orquestrar múltiplos agentes de IA colaborando em uma tarefa.
Grátis: O framework open-source (MIT) é gratuito e sem limites ao rodar no seu próprio computador ou servidor com s…
Automação e agentesDify
Plataforma open-source para criar agentes de IA, workflows e apps com LLMs, com editor visual.
Grátis: A edição Community (self-hosted) é gratuita e sem limite artificial de uso — você banca a própria infraestr…
Famílias de modelos abertosFalcon
Família open-weight do Technology Innovation Institute (Abu Dhabi): Falcon 2/3 com licença permissiva para pesquisa e produtos.
Grátis: Pesos de variantes publicadas podem ser baixados para execução própria. Confira licença, hardware e eventua…
Geração de imagemFLUX
Família de modelos de geração de imagens com variantes e licenças diferentes.
Grátis: Algumas variantes podem ser executadas localmente sem custo de licença. Confira a licença da variante escol…
Famílias de modelos abertosGemma
Família de modelos do Google com variantes disponíveis para execução local.
Grátis: Pesos de variantes publicadas podem ser baixados para execução própria. Confira a licença do modelo escolhi…
Famílias de modelos abertosGLM / ChatGLM
Família open-weight da Zhipu AI (ChatGLM / GLM-4): chat, código e agentes com pesos publicados e chat Z.ai na nuvem.
Grátis: Pesos no GitHub/Hugging Face para uso local. Chat e API Z.ai têm camadas gratuitas/limitadas — confirme cot…
Famílias de modelos abertosGranite
Família open-weight da IBM (Granite 3.x): modelos de código e linguagem com licença Apache 2.0 voltados a uso empresarial e local.
Grátis: Pesos de variantes publicadas podem ser executados em infraestrutura própria conforme licença. Serviços wat…
Automação e agentesHermes Agent
Agente de IA open-source com memória persistente, agendamento de tarefas e integração com apps de mensagem.
Grátis: O núcleo do agente é gratuito e open-source (MIT), funcionando com modelos de IA gratuitos por padrão. Há u…
Geração de vídeoHunyuanVideo 1.5
Modelo de geração de vídeo da Tencent com código e pesos para execução própria.
Grátis: Código e pesos estão disponíveis no repositório oficial para execução local. O hardware precisa ser compatí…
Famílias de modelos abertosInternLM
Família open-weight do Shanghai AI Laboratory: chat web gratuito e pesos para rodar localmente ou em servidores próprios.
Grátis: Há chat web e variantes com pesos publicados. Confira limites do chat, licença da variante e custos de hard…
IA local / self-hostedJan
Aplicativo de chat para executar modelos compatíveis no próprio computador.
Grátis: O aplicativo é aberto e pode ser usado localmente sem assinatura. Hardware, modelos e serviços externos con…
Famílias de modelos abertosLlama
Família de LLMs open-weight da Meta (Llama 3.x / 4): roda localmente via Ollama/LM Studio ou em provedores de nuvem.
Grátis: Pesos de variantes podem ser baixados para execução própria conforme licença e hardware. A Meta AI é outro…
IA local / self-hostedLM Studio
Ambiente visual para baixar, testar e conversar com modelos GGUF locais no Windows, Mac e Linux com servidor local de 1 clique.
Grátis: O aplicativo permite executar modelos compatíveis localmente. Hardware, licença de cada modelo e eventuais…
Geração de vídeoLTX-2
Modelo aberto de geração local de vídeo e áudio sincronizados, da Lightricks.
Grátis: Código e pesos são publicados para execução própria. O download exige bastante armazenamento e o uso dos pe…
Famílias de modelos abertosMistral
Família open-weight da Mistral AI (Mistral Small/Nemo, Mixtral, Codestral…): ótima relação qualidade × tamanho para rodar localmente.
Grátis: Variantes com pesos publicados podem rodar localmente conforme licença e hardware. O chat Le Chat é um prod…
Automação e agentesn8n
Plataforma de automação de workflows com nós visuais, IA integrada e forte foco em self-hosting.
Grátis: A edição para hospedagem própria pode ser usada sem assinatura da nuvem, com custo de infraestrutura. A ofe…
IA local / self-hostedOllama
Servidor e ferramenta de linha de comando para rodar LLMs e modelos multimodais no seu próprio computador com API compatível com a OpenAI.
Grátis: O software pode ser executado localmente sem assinatura. O uso depende de hardware, energia e da licença de…
Famílias de modelos abertosOLMo
Família totalmente aberta do Allen Institute for AI: pesos, código, dados e logs de treino — referência em transparência científica.
Grátis: Pesos e materiais de pesquisa podem ser baixados conforme cada versão. Confira licença, requisitos de hardw…
Automação e agentesOpenClaw
Assistente de IA autônomo open-source que roda localmente e executa tarefas reais via WhatsApp, Telegram, Discord ou Slack.
Grátis: O software é aberto e pode rodar no próprio computador. Modelos, APIs, hospedagem e serviços de mensagens c…
IDEs e assistentes de códigoOpenCode
Agente de código aberto para terminal, desktop ou editor, com opção de modelos locais e provedores externos.
Grátis: O software pode ser usado sem licença paga. Modelos locais dependem do hardware; modelos hospedados e chave…
Famílias de modelos abertosPhi
Família de SLMs da Microsoft (Phi-3 / Phi-4): modelos pequenos e capazes para CPU/GPU modesta, com pesos no Hugging Face e Azure.
Grátis: Pesos de variantes publicadas podem ser usados em execução própria conforme licença. Serviços Azure têm cus…
Geração de imagemStable Diffusion
Família de modelos de geração de imagens com variantes usadas em ferramentas locais e serviços.
Grátis: Pesos de variantes disponíveis e serviços de inferência. Consulte o site oficial para os limites gratuitos…
Geração de vídeoWan
Família de vídeo generativo com variantes publicadas para execução própria.
Grátis: Pesos e código de variantes estão disponíveis para execução própria; não há uma cota web gratuita indicada…
Transcrição, TTS e traduçãoWhisper
Modelo de reconhecimento de fala para transcrição multilíngue e tradução de fala para inglês.
Grátis: Código e pesos sob licença MIT; pode rodar localmente ou em infraestrutura própria. Consulte o site oficial…
Famílias de modelos abertosYi
Família open-weight da 01.AI (Yi-1.5 / Yi-Coder): modelos bilíngues (EN/ZH) fortes em raciocínio e código para uso local.
Grátis: Variantes com pesos publicados podem ser executadas localmente conforme licença e hardware. Chat e API, qua…
Requisitos de memória (RAM/VRAM) e hardware
Para executar modelos de linguagem ou geradores de imagem no seu próprio computador:
Escala de memória e processamento
- Memória: modelos maiores e contextos longos exigem mais RAM ou VRAM.
- Processamento: GPU pode acelerar tarefas, mas compatibilidade e velocidade variam.
- Armazenamento: reserve espaço para pesos, versões e arquivos temporários.
- Primeiro teste: comece por uma variante pequena com requisitos documentados.
Formatos de quantização explicados: GGUF vs AWQ vs EXL2
A quantização reduz o tamanho dos modelos, com possíveis efeitos na qualidade e na velocidade:
- GGUF: comum em aplicativos baseados no ecossistema llama.cpp.
- AWQ e EXL2: alternativas usadas por ferramentas e hardwares específicos.
- Confira se o formato é aceito pelo aplicativo e pelo modelo escolhido.
⚡ APIs Locais com compatibilidade OpenAI e RAG Offline
Aplicativos como Ollama e LM Studio podem expor APIs locais para integração com outras ferramentas. Consulte a documentação da versão usada. Um fluxo de busca em documentos também pode ser executado localmente, mas privacidade e conformidade dependem de toda a configuração, dos acessos e das integrações.
⚖️ Governança e Auditoria de Licenças (Checkpoint Diligence)
"Aberto" no Hugging Face não significa automaticamente "liberado para qualquer uso". É
indispensável auditar o arquivo LICENSE de cada variante de modelo antes de
colocá-la em produção:
- Software e pesos: podem estar sob licenças diferentes; confira ambos.
- Variantes: modelos da mesma família podem ter condições distintas.
- Uso comercial: leia os termos da variante exata e do serviço que a hospeda antes de lançar um produto.
