Início › IA e LLM Local
IA e LLM Local
Rodando IA no seu próprio hardware — LLMs locais, agentes e geração de imagens. Sem assinaturas, sem nuvem, sem precisar de diploma em ciência da computação.
DisPatch: um Aplicativo de Chat Self-Hosted para Agentes de IA Locais
Um aplicativo de chat de LLM hospedado localmente, servidor de arquivos e terminal — disponível em todos os dispositivos da casa, o tempo todo. O aplicativo de ~720KB que criei para substituir uma instalação do Rocket.Chat com 30 containers.
O CHUWI AuBox Ai365: Meu Laboratório Doméstico de IA numa Caixa
Um mini PC Strix Point pouco conhecido, com 2,5GbE duplo, USB4 e um Ryzen AI 9 365 — rodando Bluefin Linux, hospedando oito agentes de IA, e consumindo menos de 5 W no chip. Ele substituiu um tablet de 128 GB que morreu, e este post é atualizado à medida que a caixa muda.
StudioForge: um servidor de LLM somente GPU que substituiu o LM Studio no meu rig, operado remotamente pelos meus agentes
Escrevi o servidor de modelos que eu queria: um gateway llama.cpp compatível com OpenAI na porta 1234 que planeja a VRAM antes de carregar, recusa um modelo em vez de transbordá-lo para a CPU, fixa os que precisam permanecer aquecidos e publica 29 ferramentas MCP para que um agente em outra máquina opere o rig inteiro. Download gratuito, código-fonte no GitHub.
SiftForge: Um Assistente de E-mail com LLM Local que Lê Sua Caixa, Escreve a Resposta e Nunca a Envia
Um assistente de triagem de e-mail auto-hospedado: um listener IMAP, um modelo local e uma fila de rascunhos. Ele classifica, rotula e escreve a resposta — e para por aí. O envio é sempre um clique humano. Gratuito, MIT, download abaixo.
Oito Agentes de IA, Uma Única Máquina AMD: Minha Stack Local de Agentes (OpenClaw)
Oito agentes de IA com nome moram num único mini PC lá em casa — um recepcionista, um pensador difícil, um cavalo de batalha local de 120B, um bot de visão — com a API barata do DeepSeek fazendo o trabalho pesado por cerca de 24 dólares por mês.
DeepSeek Harness (dsh): instalei o agente de codificação open-source da DeepSeek, conectei-o ao meu aplicativo de chat e fiz benchmark dele
A DeepSeek lançou um agente de codificação sob licença MIT em 13 de agosto. Cinco dias depois, ele roda na minha máquina Bluefin como um serviço systemd, fica ao lado do Reasonix no DisPatch e passou em 15/15 tarefas em três modelos — incluindo um local. Configuração, números, pegadinhas.
Meu Agente de IA Construiu uma Ferramenta de Benchmark para Meus Agentes de IA
Pedi ao Hermes, meu agente de programação, que criasse um CLI para medir o desempenho dos meus modelos locais. Ele voltou com o bench-llm — 1.660 linhas de Python contra o LM Studio. Um ano de uso o transformou no CrucibleForge: 251 casos, 158 deles difíceis, avaliados pela execução.
Quanto Meus Agentes de IA Realmente Custam: DeepSeek vs as Grandes APIs
Dois meses da minha pilha de agentes sempre ativos custaram $30.57 no DeepSeek — $6.49 só em julho. Mas o DeepSeek aumenta os preços em 16 de agosto, e a mesma carga de trabalho de julho salta para ~$14–$27. Detalhamento completo do antigo vs. novo, além de quanto o GPT-5.6, a Claude, o Grok e o Kimi cobrariam.
Reasonix: um Agente de Codificação no Estilo Claude Code Rodando no DeepSeek
Um agente de codificação de terminal que funciona como o Claude Code — subagentes, skills, memória de projeto — mas roda sobre a API por token do DeepSeek em vez de uma assinatura. Instalação, níveis de modelo e um atualizador automático que não pede atenção.
Minha configuração OpenClaw: uma máquina só que cria sites
Um único mini-PC com Linux roda agentes OpenClaw que escrevem, constroem e publicam meus sites por um pipeline de deploy controlado e com backup — e este próprio artigo é atualizado semanalmente por essa mesma máquina.
O ASUS ROG Flow Z13: Meu Laboratório Doméstico Portátil Que Se Recusou a Ficar Portátil
Um tablet gamer com 128 GB rodava meus agentes de IA, meus sites e toda a minha rede doméstica — até que uma falha de energia passou a colocá-lo para dormir 30 segundos depois de cada ligamento. Aqui está a autópsia completa.
WordPress para Site Estático Com Claude Code: Como Reconstruí Este Site em uma Tarde
Este site rodava em WordPress. Um agente de codificação com IA o reconstruiu como arquivos Markdown mais um gerador Python de 183 linhas em uma tarde — e o mesmo fluxo de trabalho ainda o mantém.
Colocando um Chatbot na Web Pública — Com Meu Próprio Hardware
Um chatbot num site público, mas o cérebro é um modelo pequeno rodando num computador na minha casa — de graça por token e privado. Aqui está a arquitetura de retransmissão que torna isso seguro, os buracos de segurança que precisei fechar e um relato honesto de quão lento isso é e do que ainda faltaria para ser produção.
Configure Seu Assistente de LLM: Claude Code, Cowork, Terminex e DeepSeek
O guia central para o qual todo box "quer implementar isso você mesmo?" deste site aponta: o que é um assistente de LLM agêntico e quatro formas reais de ter um funcionando hoje.
OpenClaw quebrou? Eu conserto com o Claude Code
Minha estratégia em duas camadas: os agentes do OpenClaw cuidam do trabalho de rotina, e quando algo realmente quebra, o Claude Code conserta a máquina — e depois ensina o OpenClaw a lidar com isso da próxima vez.
Geração Local de Imagens com IA num Mini PC AMD: ComfyUI + Z-Image Turbo
Como transformei um mini PC AMD num gerador local de imagens com IA — ComfyUI e Z-Image Turbo rodando como serviço systemd, sem conta na nuvem, cerca de 27 segundos por imagem de 1024px.
Como Construí a OMLA Dirigindo Agentes de IA em Vez de Escrever o Código
Um cara só, sem equipe de backend: dirigi agentes de IA para programar uma plataforma real de licenciamento de royalties para uma organização sem fins lucrativos, com auditorias e deploy com portão de aprovação incluídos. O processo de verdade, não os destaques.
Como Fazer um LLM Adaptar Qualquer Projeto ao Seu Sistema
A receita geral para pegar qualquer projeto aberto — um repositório do GitHub ou um zip deste site — e fazer um assistente de IA rodá-lo na sua máquina, mesmo que você não programe.
ComfyUI Headless: Rode Como um Serviço, Use de Qualquer Lugar
A continuação da minha montagem de ComfyUI em AMD: rode-o em modo headless como um serviço systemd, controle-o a partir de scripts via API HTTP, e use a interface do navegador com segurança em qualquer dispositivo — enquanto todo workflow continua salvando na própria máquina.
Eu Construí um Aplicativo de Roteiro de Viagem para Minha Família — com um Assistente de IA Dentro Dele
Um aplicativo web de roteiro privado, protegido por PIN, para uma viagem em família ao Japão — planos dia a dia, previsão do tempo ao vivo, suporte offline, e um assistente de IA embutido que responde perguntas e faz pequenas edições. Aqui está como tudo se encaixou, pegadinhas incluídas, com uma amostra higienizada para download.
DeepSeek em Tudo Quanto É Lugar: Ligando um Cérebro de Nuvem Barato ao Claude Code e a um Stack Local de Agentes
O DeepSeek hoje sustenta, discretamente, tanto o meu stack de agentes doméstico quanto o Claude Code. Aqui estão os três padrões de ligação prontos para copiar e colar, incluindo o truque do systemd que mantém a chave de API totalmente fora do argv.
WordPress: Use IA para Criar Blocos Personalizados (Exemplo Gratuito de Acordeão)
Um acordeão gratuito para copiar e colar no WordPress — HTML e CSS puros, sem plugin, sem JavaScript — mais o prompt de IA exato que o escreveu.

DeepSeek: Rodando Localmente — um Guia de 4 Passos (Sem Experiência Necessária)
Um guia de quatro passos para rodar o DeepSeek no seu próprio PC com Ollama, Docker e Open WebUI. Sem conta na nuvem, sem assinatura — só uma placa de vídeo com 8 GB de vRAM.

AI Chef
Um único prompt de sistema, copiado e colado, transforma uma IA de chat no ProChef: cardápio semanal de jantares, receitas de verdade e uma lista de compras já organizada por setor do mercado. Roda no meu Ollama local, mas o ChatGPT comum também funciona.