Início › IA e LLM Local
IA e LLM Local
Rodando IA no seu próprio hardware — LLMs locais, agentes e geração de imagens. Sem assinaturas, sem nuvem, sem precisar de diploma em ciência da computação.
StudioForge: um servidor de LLM somente GPU que substituiu o LM Studio no meu rig, operado remotamente pelos meus agentes
Escrevi o servidor de modelos que eu queria: um gateway llama.cpp compatível com OpenAI na porta 1234 que planeja a VRAM antes de carregar, recusa um modelo em vez de transbordá-lo para a CPU, fixa os que precisam permanecer aquecidos e publica 29 ferramentas MCP para que um agente em outra máquina opere o rig inteiro. Download gratuito, código-fonte no GitHub.
Quanto Meus Agentes de IA Realmente Custam: DeepSeek vs as Grandes APIs
Dois meses da minha pilha de agentes sempre ativos custaram $30.57 no DeepSeek — $6.49 só em julho. Mas o DeepSeek aumenta os preços em 16 de agosto, e a mesma carga de trabalho de julho salta para ~$14–$27. Detalhamento completo do antigo vs. novo, além de quanto o GPT-5.6, o Claude, o Grok e o Kimi cobrariam.
MailForge: Um Assistente de E-mail baseado em LLM Local que Nunca Envia Mensagens
Um assistente de triagem de e-mails auto-hospedado: um ouvinte IMAP, um modelo local e uma fila de rascunhos. Ele classifica, rotula e redige a resposta; depois para. O envio é sempre feito por um clique humano. Gratuito, licença MIT; faça o download abaixo.
DisPatch: Um aplicativo de chat auto-hospedado para agentes de IA locais
Um aplicativo de chat auto-hospedado para agentes de IA locais, com um servidor de arquivos do tipo “arrastar e soltar” e um bloqueio por PIN imposto pelo servidor. Ele substituiu minha instalação do Rocket.Chat, que contava com 30 containers. A versão 2.0 já está disponível; o download é um arquivo zip de 3 MB.
ThemeForge: um sistema de temas CSS pronto para uso; um agente de IA o instala em apenas um passo
O ThemeForge é uma única pasta, `ui-theme/`, que oferece a um aplicativo web dez temas de cores, um seletor de cores, tokens de design e classes de componentes prontas para uso. Foi desenvolvido de forma que um agente de codificação da IA possa instalá-lo em um único passo, através de um comando Python de uma linha. Utiliza apenas CSS puro; não requer etapas de compilação nem dependências. Licença MIT. O código-fonte e o arquivo zip estão disponíveis abaixo.
ChatForge: um assistente de IA com NPU local para a Tecla Copilot
Substituí a chave do Copilot pelo meu próprio assistente: um modelo Qwen de 1,5 bilhão de parâmetros, rodando na NPU Intel do laptop, com velocidade de geração entre 42 e 51 tokens/segundo. Não é necessária nenhuma conta; nada sai do computador. Além disso, o StudioForge ou um modelo em nuvem estão disponíveis com um único clique, no mesmo pop-up. São nove ferramentas no total; basta inserir os arquivos para obter resultados em Word, Excel ou PowerPoint. Licença MIT.
Como encerrar as atividades de uma organização sem fins lucrativos: Guia prático
Passei meses criando uma estrutura de licenciamento sem fins lucrativos para modelos de IA de código aberto; depois, desisti do projeto sem nunca tê-lo lançado. O que era esse projeto, o que foi construído e o que foi necessário para encerrá-lo – tudo isso está arquivado para download.
WordPress: Use IA para Criar Blocos Personalizados (Exemplo Gratuito de Acordeão)
Um acordeão gratuito para copiar e colar no WordPress — HTML e CSS puros, sem plugin, sem JavaScript — mais o prompt de IA exato que o escreveu.
Colocando um Chatbot na Web Pública — Com Meu Próprio Hardware
Um chatbot num site público, mas o cérebro é um modelo pequeno rodando num computador na minha casa — de graça por token e privado. Aqui está a arquitetura de retransmissão que torna isso seguro, as brechas de segurança que precisei fechar e um relato honesto de quão lento isso é e do que ainda faltaria para estar pronto para produção.
Configure Seu Assistente de LLM: Claude Code, Cowork, Terminex e DeepSeek
O guia central para o qual todo box "quer implementar isso você mesmo?" deste site aponta: o que é um assistente de LLM agêntico e quatro formas reais de ter um funcionando hoje.
OpenClaw quebrou? Eu conserto com o Claude Code
Minha estratégia em duas camadas: os agentes do OpenClaw cuidam do trabalho de rotina, e quando algo realmente quebra, o Claude Code conserta a máquina — e depois ensina o OpenClaw a lidar com isso da próxima vez.
MiniMax M3: Um Agente de Programação OpenClaw versus Kimi K3 e dsh
O MiniMax M3, utilizando o próprio loop de agente do OpenClaw, concluiu cinco pequenas tarefas de programação em 159 s, contra os 310 s do Kimi K3 (Kimi no modo de processamento máximo, diferentes arquivos de teste), por um quarto do custo de tabela. O widget que inicialmente atribuí a ele era do Kimi.
Geração de imagens por IA local em AMD (ROCm): ComfyUI + Z-Image Turbo
Como transformei uma máquina AMD Strix Halo num gerador de imagens por IA local — o ComfyUI e o Z-Image Turbo são executados como um serviço do systemd, sem conta na nuvem, cerca de 27 segundos por imagem de 1024px.
Kimi K3 no OpenClaw versus dsh: 5/5 tarefas, 9× mais lento, 48× o custo
O Kimi K3 da Moonshot a executar o ciclo de agentes do OpenClaw em cinco pequenas tarefas de programação: 5/5 aprovadas, cerca de 9× mais lento e 48× mais caro do que o dsh no modo warm do DeepSeek V4-Flash (22× em comparação com o modo cold). O brief do widget em pixel art exigiu três tentativas.
InfoForge: Wikipédia offline como fonte RAG para os meus agentes de IA locais
Toda a Wikipédia em inglês — 19,19 milhões de entradas, 52,69 GB, sem internet — atrás de um índice de busca local que os meus agentes de IA podem consultar. Cada resposta cita os seus artigos e, quando não encontra nenhum, diz isso em vez de adivinhar.
Como criei o OMLA: direcionando agentes de IA em vez de escrever o código
Um único cara, sem equipe de backend: orientei agentes de codificação de IA a criar uma plataforma real de licenciamento de direitos autorais para uma organização sem fins lucrativos, incluindo auditorias e implantações controladas. O processo real, não o resumo promocional.
Como fazer com que um LLM adapte qualquer projeto ao seu sistema
A receita geral para pegar qualquer projeto aberto — um repositório do GitHub ou um arquivo zip deste site — e fazer com que um assistente de IA o execute na sua máquina, mesmo que você não saiba programar.
Eu Construí um Aplicativo de Roteiro de Viagem para Minha Família — com um Assistente de IA Dentro Dele
Um aplicativo web de roteiro privado, protegido por PIN, para uma viagem em família ao Japão — planos dia a dia, previsão do tempo ao vivo, suporte offline, e um assistente de IA embutido que responde perguntas e faz pequenas edições. Aqui está como tudo se encaixou, pegadinhas incluídas, com uma amostra higienizada para download.

DeepSeek: Rodando Localmente — um Guia de 4 Passos (Sem Experiência Necessária)
Um guia de quatro passos para rodar o DeepSeek no seu próprio PC com Ollama, Docker e Open WebUI. Sem conta na nuvem, sem assinatura — só uma placa de vídeo com 8 GB de vRAM.
DeepSeek Harness (dsh): Instalação, Execuções headless, Teste de desempenho com 3 modelos
O agente de codificação do DeepSeek, licenciado sob MIT, foi instalado cinco dias após seu lançamento: instalação via npm, um modo headless de execução única projetado para scripts, uma unidade systemd, troca de modelos em um único arquivo YAML, e 15/15 aprovações no V4-Flash, V4-Pro e em um Gemma local por alguns centavos.
DeepSeek em toda parte: Claude Code e uma pilha de agentes locais
Em julho de 2026, o DeepSeek apoiou discretamente tanto a minha pilha de agentes domésticos quanto o Claude Code. Seguem-se três padrões de configuração que podem ser copiados e colados, incluindo o truque do systemd que mantém a chave da API completamente fora do argv.
Meu Agente de IA Criou uma Ferramenta de Benchmarking para os Meus Agentes de IA
O meu agente de programação escreveu o bench-llm: são 1.660 linhas de código Python que servem para fazer benchmark dos modelos locais no LM Studio. Em duas semanas, todos os meus modelos obtiveram uma pontuação de 5/5; por isso, substituí esse script pelo CrucibleForge: são 251 casos de teste, sendo 158 considerados difíceis. O código já está disponível no GitHub.
Showdown de Widgets em Pixel Art: Três Agentes de Codificação, Um Briefing, Dois Autores
Dei ao dsh, ao Kimi K3 e ao MiniMax M3 o mesmo pedido: criarem um widget em pixel-art do logotipo LaserLloyd. O dsh e o Kimi criaram widgets que funcionavam. O MiniMax respondeu que também havia criado um, mas os arquivos aos quais ele se referiu eram, na verdade, os do Kimi.
Minha configuração OpenClaw: uma máquina só que cria sites
Um único mini-PC com Linux roda agentes OpenClaw que escrevem, constroem e publicam meus sites por um pipeline de deploy controlado e com backup — todo deploy faz dry-run primeiro, faz backup do servidor e espera meu aval.
Oito Agentes de IA, Uma Única Máquina AMD: Minha Stack Local de Agentes (OpenClaw)
Oito agentes de IA com nome moram num único mini PC lá em casa — um despachante, um pensador para os problemas difíceis, um cavalo de batalha local, um bot de visão — com a API barata do DeepSeek fazendo o trabalho pesado por cerca de 24 dólares por mês.
O CHUWI AuBox Ai365: Meu Laboratório Doméstico de IA numa Caixa
Um mini PC Strix Point pouco conhecido, com 2,5GbE duplo, USB4 e um Ryzen AI 9 365 — rodando Bluefin Linux, hospedando oito agentes de IA, e consumindo menos de 5 W no chip. Ele substituiu um tablet de 128 GB que morreu, e este post é atualizado à medida que a caixa muda.
Reasonix: um Agente de Codificação no Estilo Claude Code Rodando no DeepSeek
Um agente de codificação de terminal que funciona como o Claude Code — subagentes, skills, memória de projeto — mas roda sobre a API paga por token do DeepSeek em vez de uma assinatura. Instalação, níveis de modelo e um atualizador automático que não pede atenção.
O ASUS ROG Flow Z13: Meu Laboratório Doméstico Portátil Que Se Recusou a Ficar Portátil
Um tablet gamer com 128 GB rodava meus agentes de IA, meus sites e toda a minha rede doméstica — até que uma falha de energia passou a colocá-lo para dormir 30 segundos depois de cada vez que era ligado. Aqui está a autópsia completa.
WordPress para Site Estático Com Claude Code: Um Site Reconstruído em uma Tarde
Este site rodava em WordPress. Um agente de codificação com IA o reconstruiu como arquivos Markdown mais um gerador Python de 183 linhas em uma tarde — e o mesmo fluxo de trabalho ainda o mantém.
ComfyUI Headless: Rode Como um Serviço, Use de Qualquer Lugar
A continuação da minha montagem de ComfyUI em AMD: rode-o em modo headless como um serviço systemd, controle-o a partir de scripts via API HTTP, e use a interface do navegador com segurança em qualquer dispositivo — enquanto todo workflow continua sendo salvo na própria máquina.

AI Chef
Um único prompt de sistema, copiado e colado, transforma uma IA de chat no ProChef: cardápio semanal de jantares, receitas de verdade e uma lista de compras já organizada por setor do mercado. Roda no meu Ollama local, mas o ChatGPT comum também funciona.