IA e LLM Local

Rodando IA no seu próprio hardware — LLMs locais, agentes e geração de imagens. Sem assinaturas, sem nuvem, sem precisar de diploma em ciência da computação.

IA e LLM Local

StudioForge: um servidor de LLM somente GPU que substituiu o LM Studio no meu rig, operado remotamente pelos meus agentes

Escrevi o servidor de modelos que eu queria: um gateway llama.cpp compatível com OpenAI na porta 1234 que planeja a VRAM antes de carregar, recusa um modelo em vez de transbordá-lo para a CPU, fixa os que precisam permanecer aquecidos e publica 29 ferramentas MCP para que um agente em outra máquina opere o rig inteiro. Download gratuito, código-fonte no GitHub.

23 agosto 2026 · Atualizado em 27 agosto 2026
IA e LLM Local

Quanto Meus Agentes de IA Realmente Custam: DeepSeek vs as Grandes APIs

Dois meses da minha pilha de agentes sempre ativos custaram $30.57 no DeepSeek — $6.49 só em julho. Mas o DeepSeek aumenta os preços em 16 de agosto, e a mesma carga de trabalho de julho salta para ~$14–$27. Detalhamento completo do antigo vs. novo, além de quanto o GPT-5.6, o Claude, o Grok e o Kimi cobrariam.

11 julho 2026 · Atualizado em 14 agosto 2026
IA e LLM Local

MailForge: Um Assistente de E-mail baseado em LLM Local que Nunca Envia Mensagens

Um assistente de triagem de e-mails auto-hospedado: um ouvinte IMAP, um modelo local e uma fila de rascunhos. Ele classifica, rotula e redige a resposta; depois para. O envio é sempre feito por um clique humano. Gratuito, licença MIT; faça o download abaixo.

19 agosto 2026 · Atualizado em 10 outubro 2026
IA e LLM Local

DisPatch: Um aplicativo de chat auto-hospedado para agentes de IA locais

Um aplicativo de chat auto-hospedado para agentes de IA locais, com um servidor de arquivos do tipo “arrastar e soltar” e um bloqueio por PIN imposto pelo servidor. Ele substituiu minha instalação do Rocket.Chat, que contava com 30 containers. A versão 2.0 já está disponível; o download é um arquivo zip de 3 MB.

11 julho 2026 · Atualizado em 9 outubro 2026
IA e LLM Local

ThemeForge: um sistema de temas CSS pronto para uso; um agente de IA o instala em apenas um passo

O ThemeForge é uma única pasta, `ui-theme/`, que oferece a um aplicativo web dez temas de cores, um seletor de cores, tokens de design e classes de componentes prontas para uso. Foi desenvolvido de forma que um agente de codificação da IA possa instalá-lo em um único passo, através de um comando Python de uma linha. Utiliza apenas CSS puro; não requer etapas de compilação nem dependências. Licença MIT. O código-fonte e o arquivo zip estão disponíveis abaixo.

5 outubro 2026 · Atualizado em 6 outubro 2026
IA e LLM Local

ChatForge: um assistente de IA com NPU local para a Tecla Copilot

Substituí a chave do Copilot pelo meu próprio assistente: um modelo Qwen de 1,5 bilhão de parâmetros, rodando na NPU Intel do laptop, com velocidade de geração entre 42 e 51 tokens/segundo. Não é necessária nenhuma conta; nada sai do computador. Além disso, o StudioForge ou um modelo em nuvem estão disponíveis com um único clique, no mesmo pop-up. São nove ferramentas no total; basta inserir os arquivos para obter resultados em Word, Excel ou PowerPoint. Licença MIT.

2 outubro 2026 · Atualizado em 3 outubro 2026
IA e LLM Local

Como encerrar as atividades de uma organização sem fins lucrativos: Guia prático

Passei meses criando uma estrutura de licenciamento sem fins lucrativos para modelos de IA de código aberto; depois, desisti do projeto sem nunca tê-lo lançado. O que era esse projeto, o que foi construído e o que foi necessário para encerrá-lo – tudo isso está arquivado para download.

18 setembro 2026
IA e LLM Local

WordPress: Use IA para Criar Blocos Personalizados (Exemplo Gratuito de Acordeão)

Um acordeão gratuito para copiar e colar no WordPress — HTML e CSS puros, sem plugin, sem JavaScript — mais o prompt de IA exato que o escreveu.

12 março 2025 · Atualizado em 16 setembro 2026
IA e LLM Local

Colocando um Chatbot na Web Pública — Com Meu Próprio Hardware

Um chatbot num site público, mas o cérebro é um modelo pequeno rodando num computador na minha casa — de graça por token e privado. Aqui está a arquitetura de retransmissão que torna isso seguro, as brechas de segurança que precisei fechar e um relato honesto de quão lento isso é e do que ainda faltaria para estar pronto para produção.

11 julho 2026 · Atualizado em 16 setembro 2026
IA e LLM Local

Configure Seu Assistente de LLM: Claude Code, Cowork, Terminex e DeepSeek

O guia central para o qual todo box "quer implementar isso você mesmo?" deste site aponta: o que é um assistente de LLM agêntico e quatro formas reais de ter um funcionando hoje.

11 julho 2026 · Atualizado em 16 setembro 2026
IA e LLM Local

OpenClaw quebrou? Eu conserto com o Claude Code

Minha estratégia em duas camadas: os agentes do OpenClaw cuidam do trabalho de rotina, e quando algo realmente quebra, o Claude Code conserta a máquina — e depois ensina o OpenClaw a lidar com isso da próxima vez.

11 julho 2026 · Atualizado em 16 setembro 2026
IA e LLM Local

MiniMax M3: Um Agente de Programação OpenClaw versus Kimi K3 e dsh

O MiniMax M3, utilizando o próprio loop de agente do OpenClaw, concluiu cinco pequenas tarefas de programação em 159 s, contra os 310 s do Kimi K3 (Kimi no modo de processamento máximo, diferentes arquivos de teste), por um quarto do custo de tabela. O widget que inicialmente atribuí a ele era do Kimi.

12 setembro 2026 · Atualizado em 16 setembro 2026
IA e LLM Local

Geração de imagens por IA local em AMD (ROCm): ComfyUI + Z-Image Turbo

Como transformei uma máquina AMD Strix Halo num gerador de imagens por IA local — o ComfyUI e o Z-Image Turbo são executados como um serviço do systemd, sem conta na nuvem, cerca de 27 segundos por imagem de 1024px.

11 julho 2026 · Atualizado em 16 setembro 2026
IA e LLM Local

Kimi K3 no OpenClaw versus dsh: 5/5 tarefas, 9× mais lento, 48× o custo

O Kimi K3 da Moonshot a executar o ciclo de agentes do OpenClaw em cinco pequenas tarefas de programação: 5/5 aprovadas, cerca de 9× mais lento e 48× mais caro do que o dsh no modo warm do DeepSeek V4-Flash (22× em comparação com o modo cold). O brief do widget em pixel art exigiu três tentativas.

12 setembro 2026 · Atualizado em 16 setembro 2026
IA e LLM Local

InfoForge: Wikipédia offline como fonte RAG para os meus agentes de IA locais

Toda a Wikipédia em inglês — 19,19 milhões de entradas, 52,69 GB, sem internet — atrás de um índice de busca local que os meus agentes de IA podem consultar. Cada resposta cita os seus artigos e, quando não encontra nenhum, diz isso em vez de adivinhar.

28 agosto 2026 · Atualizado em 16 setembro 2026
IA e LLM Local

Como criei o OMLA: direcionando agentes de IA em vez de escrever o código

Um único cara, sem equipe de backend: orientei agentes de codificação de IA a criar uma plataforma real de licenciamento de direitos autorais para uma organização sem fins lucrativos, incluindo auditorias e implantações controladas. O processo real, não o resumo promocional.

11 julho 2026 · Atualizado em 16 setembro 2026
IA e LLM Local

Como fazer com que um LLM adapte qualquer projeto ao seu sistema

A receita geral para pegar qualquer projeto aberto — um repositório do GitHub ou um arquivo zip deste site — e fazer com que um assistente de IA o execute na sua máquina, mesmo que você não saiba programar.

11 julho 2026 · Atualizado em 16 setembro 2026
IA e LLM Local

Eu Construí um Aplicativo de Roteiro de Viagem para Minha Família — com um Assistente de IA Dentro Dele

Um aplicativo web de roteiro privado, protegido por PIN, para uma viagem em família ao Japão — planos dia a dia, previsão do tempo ao vivo, suporte offline, e um assistente de IA embutido que responde perguntas e faz pequenas edições. Aqui está como tudo se encaixou, pegadinhas incluídas, com uma amostra higienizada para download.

11 julho 2026 · Atualizado em 16 setembro 2026
IA e LLM Local

DeepSeek: Rodando Localmente — um Guia de 4 Passos (Sem Experiência Necessária)

Um guia de quatro passos para rodar o DeepSeek no seu próprio PC com Ollama, Docker e Open WebUI. Sem conta na nuvem, sem assinatura — só uma placa de vídeo com 8 GB de vRAM.

11 fevereiro 2025 · Atualizado em 16 setembro 2026
IA e LLM Local

DeepSeek Harness (dsh): Instalação, Execuções headless, Teste de desempenho com 3 modelos

O agente de codificação do DeepSeek, licenciado sob MIT, foi instalado cinco dias após seu lançamento: instalação via npm, um modo headless de execução única projetado para scripts, uma unidade systemd, troca de modelos em um único arquivo YAML, e 15/15 aprovações no V4-Flash, V4-Pro e em um Gemma local por alguns centavos.

18 agosto 2026 · Atualizado em 16 setembro 2026
IA e LLM Local

DeepSeek em toda parte: Claude Code e uma pilha de agentes locais

Em julho de 2026, o DeepSeek apoiou discretamente tanto a minha pilha de agentes domésticos quanto o Claude Code. Seguem-se três padrões de configuração que podem ser copiados e colados, incluindo o truque do systemd que mantém a chave da API completamente fora do argv.

11 julho 2026 · Atualizado em 16 setembro 2026
IA e LLM Local

Meu Agente de IA Criou uma Ferramenta de Benchmarking para os Meus Agentes de IA

O meu agente de programação escreveu o bench-llm: são 1.660 linhas de código Python que servem para fazer benchmark dos modelos locais no LM Studio. Em duas semanas, todos os meus modelos obtiveram uma pontuação de 5/5; por isso, substituí esse script pelo CrucibleForge: são 251 casos de teste, sendo 158 considerados difíceis. O código já está disponível no GitHub.

11 agosto 2026 · Atualizado em 16 setembro 2026
IA e LLM Local

Showdown de Widgets em Pixel Art: Três Agentes de Codificação, Um Briefing, Dois Autores

Dei ao dsh, ao Kimi K3 e ao MiniMax M3 o mesmo pedido: criarem um widget em pixel-art do logotipo LaserLloyd. O dsh e o Kimi criaram widgets que funcionavam. O MiniMax respondeu que também havia criado um, mas os arquivos aos quais ele se referiu eram, na verdade, os do Kimi.

12 setembro 2026 · Atualizado em 12 setembro 2026
IA e LLM Local

Minha configuração OpenClaw: uma máquina só que cria sites

Um único mini-PC com Linux roda agentes OpenClaw que escrevem, constroem e publicam meus sites por um pipeline de deploy controlado e com backup — todo deploy faz dry-run primeiro, faz backup do servidor e espera meu aval.

31 julho 2026 · Atualizado em 26 agosto 2026
IA e LLM Local

Oito Agentes de IA, Uma Única Máquina AMD: Minha Stack Local de Agentes (OpenClaw)

Oito agentes de IA com nome moram num único mini PC lá em casa — um despachante, um pensador para os problemas difíceis, um cavalo de batalha local, um bot de visão — com a API barata do DeepSeek fazendo o trabalho pesado por cerca de 24 dólares por mês.

11 julho 2026 · Atualizado em 26 agosto 2026
IA e LLM Local

O CHUWI AuBox Ai365: Meu Laboratório Doméstico de IA numa Caixa

Um mini PC Strix Point pouco conhecido, com 2,5GbE duplo, USB4 e um Ryzen AI 9 365 — rodando Bluefin Linux, hospedando oito agentes de IA, e consumindo menos de 5 W no chip. Ele substituiu um tablet de 128 GB que morreu, e este post é atualizado à medida que a caixa muda.

1 agosto 2026 · Atualizado em 26 agosto 2026
IA e LLM Local

Reasonix: um Agente de Codificação no Estilo Claude Code Rodando no DeepSeek

Um agente de codificação de terminal que funciona como o Claude Code — subagentes, skills, memória de projeto — mas roda sobre a API paga por token do DeepSeek em vez de uma assinatura. Instalação, níveis de modelo e um atualizador automático que não pede atenção.

11 julho 2026 · Atualizado em 1 agosto 2026
IA e LLM Local

O ASUS ROG Flow Z13: Meu Laboratório Doméstico Portátil Que Se Recusou a Ficar Portátil

Um tablet gamer com 128 GB rodava meus agentes de IA, meus sites e toda a minha rede doméstica — até que uma falha de energia passou a colocá-lo para dormir 30 segundos depois de cada vez que era ligado. Aqui está a autópsia completa.

30 julho 2026 · Atualizado em 1 agosto 2026
IA e LLM Local

WordPress para Site Estático Com Claude Code: Um Site Reconstruído em uma Tarde

Este site rodava em WordPress. Um agente de codificação com IA o reconstruiu como arquivos Markdown mais um gerador Python de 183 linhas em uma tarde — e o mesmo fluxo de trabalho ainda o mantém.

11 julho 2026
IA e LLM Local

ComfyUI Headless: Rode Como um Serviço, Use de Qualquer Lugar

A continuação da minha montagem de ComfyUI em AMD: rode-o em modo headless como um serviço systemd, controle-o a partir de scripts via API HTTP, e use a interface do navegador com segurança em qualquer dispositivo — enquanto todo workflow continua sendo salvo na própria máquina.

11 julho 2026 · Atualizado em 11 julho 2026
IA e LLM Local

AI Chef

Um único prompt de sistema, copiado e colado, transforma uma IA de chat no ProChef: cardápio semanal de jantares, receitas de verdade e uma lista de compras já organizada por setor do mercado. Roda no meu Ollama local, mas o ChatGPT comum também funciona.

19 dezembro 2024