Inicio › IA y LLM Local
IA y LLM Local
IA en tu propio hardware — LLM locales, agentes y generación de imágenes. Sin suscripciones, sin nube, sin necesidad de un título en informática.
Cuánto cuestan realmente mis agentes de IA: DeepSeek frente a las grandes API
Tres meses de uso de mi conjunto de agentes siempre activos: $30,57 en DeepSeek durante junio y julio; luego $385,22 en agosto, tras el aumento de precios anunciado por DeepSeek el 16 de agosto y la contratación de dos suscripciones nuevas. A continuación, el desglose mensual, los cambios producidos y cuánto habrían costado los servicios si se hubieran optado por los planes estrella.
StudioForge: un servidor LLM solo-GPU que reemplazó a LM Studio en mi equipo y que mis agentes manejan a distancia
Escribí el servidor de modelos que quería: una puerta de enlace llama.cpp compatible con OpenAI en el puerto 1234 que planifica la VRAM antes de cargar, rechaza un modelo antes que volcarlo a la CPU, mantiene fijos los que deben seguir calientes y publica 29 herramientas MCP para que un agente en otra máquina maneje todo el equipo. Descarga gratuita, código fuente en GitHub.
MailForge: Un asistente de correo basado en LLM local que nunca envía mensajes
Un asistente de triaje de correos autoalojado: un listener IMAP, un modelo local y una cola de borradores. Clasifica, etiqueta y redacta la respuesta; luego se detiene. El envío siempre requiere un clic humano. Gratis, bajo licencia MIT; descárguelo a continuación.
DisPatch: Una aplicación de chat autohospedada para agentes de IA locales
Una aplicación de chat autoalojada para agentes de IA locales, con un servidor de archivos tipo arrastrar y soltar y un bloqueo por PIN impuesto por el servidor. Reemplazó mi instalación de Rocket.Chat, que constaba de 30 contenedores. Ya está disponible la versión 2.0; el archivo de descarga es un zip de 3 MB.
ThemeForge: un sistema de temas CSS listo para usar; un agente de IA lo instala en un solo paso.
ThemeForge es una única carpeta, `ui-theme/`, que proporciona a las aplicaciones web diez temas de color, un selector, tokens de diseño y clases de componentes ya listas para usar. Está programado de tal manera que un agente de codificación de IA pueda instalarlo en un solo paso mediante un único comando Python. Utiliza CSS plano; no requiere procesos de compilación ni dependencias. Licencia MIT. El código fuente y el archivo zip se encuentran a continuación.
ChatForge: un asistente de IA local con NPU para la tecla Copilot
Mi portátil venía con una tecla de IA y un chip de IA que nunca se habían “conocido”. ChatForge los reúne: pulse la tecla Copilot y obtendrá un modelo Qwen de 1,5 mil millones de parámetros que responderá mediante la unidad NPU de Intel, a una velocidad de 42–51 tokens por segundo. No se requiere cuenta alguna; nada sale del ordenador. Además, StudioForge o un modelo en la nube están disponibles con un solo clic. MIT; el código fuente y el archivo zip se encuentran más abajo.
Cómo dar por terminada una organización sin fines de lucro: Procedimientos para cerrar una ONG
Pasé meses desarrollando un marco de licencias sin fines de lucro para modelos de IA de peso abierto; luego lo abandoné sin llegar a lanzarlo nunca. Qué era, qué se construyó y qué implicó realmente su cierre: todo ello se ha archivado para su descarga.
WordPress: usa IA para crear bloques personalizados (ejemplo gratis de acordeón)
Un acordeón gratis para copiar y pegar en WordPress — HTML y CSS puros, sin plugin, sin JavaScript — más el prompt exacto de IA que lo escribió.
Poner un chatbot en la web pública — con mi propio hardware
Un chatbot en un sitio web público, pero el cerebro es un modelo pequeño que corre en una computadora de mi casa — gratis por token y privado. Aquí está la arquitectura de relevo que lo hace seguro, los agujeros de seguridad que tuve que cerrar y un balance honesto de cuán lento es y qué más necesitaría para estar listo para producción.
Configura tu asistente de LLM: Claude Code, Cowork, Terminex y DeepSeek
La guía central a la que apunta cada recuadro de "impleméntalo tú mismo" de este sitio: qué es un asistente de LLM agéntico y cuatro formas reales de tener uno funcionando hoy mismo.
¿OpenClaw roto? Lo arreglo con Claude Code
Mi estrategia de reparación en dos niveles: los agentes de OpenClaw se encargan del trabajo rutinario, y cuando algo se rompe de verdad, Claude Code arregla la máquina — y después le enseña a OpenClaw a manejarlo la próxima vez.
MiniMax M3: Un agente de programación OpenClaw frente a Kimi K3 y dsh
El MiniMax M3, utilizando el propio bucle de agente de OpenClaw, completó cinco pequeñas tareas de programación en 159 segundos; en comparación, el Kimi K3 necesitó 310 segundos (con Kimi operando en modo de razonamiento máximo y con configuraciones distintas). Todo esto a un cuarto del precio de lista. El widget al que inicialmente le atribuí este mérito era, en realidad, de Kimi.
Generación de imágenes por IA local en AMD (ROCm): ComfyUI + Z-Image Turbo
Cómo convertí una máquina AMD Strix Halo en un generador de imágenes por IA local: ComfyUI y Z-Image Turbo se ejecutan como un servicio de systemd, sin necesidad de cuenta en la nube; el tiempo de generación es de unos 27 segundos por imagen a 1024 píxeles.
Kimi K3 en OpenClaw frente a dsh: 5/5 tareas, 9 veces más lento y 48 veces el coste
Kimi K3 de Moonshot impulsa el bucle de agentes de OpenClaw en cinco tareas pequeñas de programación: 5/5 superadas, unas 9 veces más lento y 48 veces más caro que dsh con DeepSeek V4-Flash en su pasada en caliente (22 veces frente a su pasada en frío). El encargo del widget de pixel art requirió tres intentos.
InfoForge: Wikipedia sin conexión como fuente RAG para mis agentes de IA locales
Toda la Wikipedia en inglés: 19,19 millones de entradas, 52,69 GB, sin internet—detrás de un índice de búsqueda que mis agentes de IA consultan en milisegundos. Cada respuesta cita sus artículos, y cuando no encuentra uno, lo dice en lugar de adivinar.
Cómo construí OMLA dirigiendo agentes de IA en lugar de escribir el código
Una sola persona, sin equipo de backend: dirigí agentes de IA para construir una plataforma real de licencias por regalías para una organización sin fines de lucro, con auditorías y despliegue bajo aprobación incluidos. El proceso real, no el resumen de los mejores momentos.
Cómo hacer que un LLM adapte cualquier proyecto a tu sistema
La receta general para tomar cualquier proyecto abierto — un repositorio de GitHub o un zip de este sitio — y lograr que un asistente de IA lo haga funcionar en tu equipo, aunque no sepas programar.
Le construí a mi familia una app de itinerario de viaje — con un asistente de IA dentro
Una app web de itinerario privada, protegida con PIN, para un viaje familiar a Japón — planes día a día, clima en vivo, soporte sin conexión, y un asistente de IA integrado que puede responder preguntas y hacer pequeñas ediciones. Así fue como se hizo realidad, con sus tropiezos incluidos, junto con una muestra depurada que puedes descargar.

DeepSeek en local: guía de 4 pasos (sin experiencia previa)
Una guía de cuatro pasos para ejecutar DeepSeek en tu propio PC con Ollama, Docker y Open WebUI. Sin cuenta en la nube, sin suscripción — solo una tarjeta gráfica con 8 GB de vRAM.
DeepSeek en todas partes: Claude Code y un stack de agentes local
En julio de 2026 DeepSeek respaldó en silencio tanto mi stack de agentes doméstico como Claude Code. Aquí van los tres patrones de cableado listos para copiar y pegar, incluido el truco de systemd que mantiene la clave de la API completamente fuera del argv.
Mi agente de IA creó una herramienta de evaluación para mis agentes de IA
Mi agente de programación escribió bench-llm: 1,660 líneas de Python que evalúan modelos locales en LM Studio. En dos semanas todos mis modelos obtuvieron 5/5, así que lo reemplacé por CrucibleForge: 251 casos, 158 difíciles, ahora en GitHub.
Duelo de widgets de pixel art: tres agentes de programación, un mismo encargo, dos autores
Le di a dsh, Kimi K3 y MiniMax M3 las mismas instrucciones para crear un widget de logo LaserLloyd en estilo pixel-art. Dsh y Kimi desarrollaron widgets que funcionaban correctamente. MiniMax respondió que también había creado uno, pero los archivos a los que hacía referencia eran los de Kimi.
Mi configuración de OpenClaw: una sola máquina que puede crear sitios web
Un mini PC con Linux ejecuta agentes de OpenClaw que redactan, compilan y publican mis sitios web mediante una canalización de despliegue controlada y con copia de seguridad — cada despliegue primero se simula, hace una copia de seguridad del servidor y espera mi visto bueno.
Ocho agentes de IA, una caja AMD: mi pila local de agentes (OpenClaw)
Ocho agentes de IA con nombre propio viven en una mini PC de mi casa — un despachador, un pensador serio, un caballo de batalla local, un bot de visión — con la API barata de DeepSeek haciendo el trabajo pesado por unos $24 al mes.
DeepSeek Harness (dsh): Cómo instalé el agente de codificación de código abierto de DeepSeek, lo integré en mi aplicación de chat y lo evalué
DeepSeek lanzó un agente de codificación con licencia MIT el 13 de agosto. Cinco días después corre en mi equipo Bluefin como servicio systemd, está junto a Reasonix en DisPatch y pasó 15/15 tareas en tres modelos, incluido uno local. Instalación, cifras y problemas.
El CHUWI AuBox Ai365: mi laboratorio de IA doméstico en una caja
Un mini PC Strix Point poco conocido con doble 2.5GbE, USB4 y un Ryzen AI 9 365 — corriendo Linux Bluefin, alojando ocho agentes de IA, y consumiendo menos de 5 W en el chip. Reemplazó a una tablet muerta de 128 GB, y esta entrada se actualiza a medida que cambia la caja.
Reasonix: Un agente de programación al estilo Claude Code en DeepSeek
Un agente de codificación para terminal que funciona de forma similar a Claude Code: subagentes, habilidades, memoria del proyecto, etc. Sin embargo, utiliza la API de pago por token de DeepSeek en lugar de un modelo de suscripción. Incluye configuración sencilla, diferentes niveles de modelos y un actualizador automático que no requiere intervención del usuario.
El ASUS ROG Flow Z13: mi laboratorio doméstico portátil que se negó a quedarse portátil
Una tablet gaming de 128 GB corría mis agentes de IA, mis sitios web y toda mi red doméstica — hasta que una falla de alimentación empezó a ponerla en reposo 30 segundos después de cada encendido. Aquí está la autopsia completa.
De WordPress a estático con Claude Code: cómo reconstruí este sitio en una tarde
Este sitio antes funcionaba con WordPress. Un agente de codificación con IA lo reconstruyó como archivos Markdown más un generador en Python de 183 líneas en una sola tarde, y ese mismo flujo de trabajo sigue manteniéndolo.
ComfyUI sin interfaz: ejecútalo como servicio, úsalo desde cualquier lugar
La continuación de mi montaje de ComfyUI en AMD: ejecutarlo sin interfaz como servicio systemd, controlarlo desde scripts a través de la API HTTP, y usar la interfaz del navegador de forma segura desde cualquier dispositivo — mientras cada workflow se sigue guardando en la máquina.

Chef IA: Un prompt de sistema gratuito para la planificación semanal de comidas
Un único prompt de sistema, copiado y pegado, convierte a una IA en ProChef: planes semanales para la cena, recetas reales y una lista de compras organizada por secciones del supermercado. Funciona en mi servidor local Ollama, pero el ChatGPT normal también sirve.