KI & lokale LLMs

KI auf eigener Hardware betreiben — lokale LLMs, Agenten und Bildgenerierung. Keine Abos, keine Cloud, kein Informatikstudium nötig.

KI & lokale LLMs

StudioForge: Ein GPU-Only-LLM-Server, der LM Studio auf meinem Rig ersetzt hat – ferngesteuert von meinen Agenten

Ich habe den Modellserver geschrieben, den ich selbst wollte: ein OpenAI-kompatibles llama.cpp-Gateway auf Port 1234, das den VRAM plant, bevor es lädt, ein Modell ablehnt statt es auf die CPU auszulagern, diejenigen pinnt, die warm bleiben müssen, und 29 MCP-Tools veröffentlicht, damit ein Agent auf einem anderen Rechner das ganze Rig steuert. Kostenloser Download, Quellcode auf GitHub.

23 August 2026 · Aktualisiert 27 August 2026
KI & lokale LLMs

Was meine KI-Agenten tatsächlich kosten: DeepSeek vs. die großen APIs

Zwei Monate meines dauerlaufenden Agenten-Stacks haben auf DeepSeek $30.57 gekostet — im Juli allein $6.49. Aber DeepSeek erhöht am 16. August die Preise, und dieselbe Juli-Last steigt auf ~$14–$27. Die komplette Alt-gegen-Neu-Aufschlüsselung, plus was GPT-5.6, Claude, Grok und Kimi verlangen würden.

11 Juli 2026 · Aktualisiert 14 August 2026
KI & lokale LLMs

MailForge: Ein lokaler LLM-E-Mail-Assistent, der niemals E-Mails versendet

Ein selbstgehosteter E-Mail-Triage-Assistent: ein IMAP-Listener, ein lokales Modell sowie eine Warteschlange für Entwürfe. Er klassifiziert, kennzeichnet und verfasst die Antwort – danach stoppt er. Das Versenden erfolgt stets durch einen Klick des Benutzers. Kostenlos, unter MIT-Lizenz; Download unten.

19 August 2026 · Aktualisiert 10 Oktober 2026
KI & lokale LLMs

DisPatch: Eine selbstgehostete Chat-App für lokale KI-Agenten

Eine selbstgehostete Chat-App für lokale KI-Agenten – mit einem Drag-and-Drop-Dateiserver sowie einer vom Server erzwungenen PIN-Sperre. Sie hat meine bisherige Rocket.Chat-Installation mit 30 Containern ersetzt. Die Version 2.0 ist jetzt verfügbar; das Download-Paket ist eine 3 MB große ZIP-Datei.

11 Juli 2026 · Aktualisiert 9 Oktober 2026
KI & lokale LLMs

ThemeForge: Ein einfach zu installierendes CSS-Theme-System – von einem KI-Agenten in nur einem Schritt eingerichtet.

ThemeForge ist ein einziger Ordner, `ui-theme/`, der einer Web-App zehn Farbthemen, einen Auswähler, Design-Tokens sowie fertige Komponentenklassen zur Verfügung stellt – und er wurde so geschrieben, dass ein KI-Coding-Agent ihn in einem Schritt mittels eines einzeiligen Python-Befehls installieren kann. Reines CSS, kein Build-Schritt, keine Abhängigkeiten; MIT-Lizenz; Quellcode und ZIP-Datei unten.

5 Oktober 2026 · Aktualisiert 6 Oktober 2026
KI & lokale LLMs

ChatForge: Ein lokaler NPU-KI-Assistent für die Copilot-Taste

Mein Laptop wurde mit einem AI-Key sowie einem AI-Chip ausgeliefert – die beiden hatten bisher noch nie Kontakt zueinander gehabt. ChatForge bringt sie zusammen: Drücken Sie die Copilot-Taste, und schon erhalten Sie eine Antwort vom 1,5-Milliarden-Parameter starken Qwen-Modell auf dem Intel NPU – mit einer Geschwindigkeit von 42–51 Tokens pro Sekunde. Kein Konto erforderlich; nichts verlässt den PC. Mit StudioForge oder einem Cloud-Modell ist das Ganze per Klick möglich. MIT-Quellcode sowie ZIP-Datei finden Sie unten.

2 Oktober 2026 · Aktualisiert 3 Oktober 2026
KI & lokale LLMs

Abschließend: Wie man eine gemeinnützige Organisation stilllegt

Monatelang habe ich an einem gemeinnützigen Lizenzrahmenwerk für Open-Weight-KI-Modelle gearbeitet – anschließend habe ich es wieder aufgegeben, ohne es jemals zu veröffentlichen. Was es war, was entwickelt wurde und welche Schritte nötig waren, um das Projekt einzustellen – all das ist nun archiviert und zum Download verfügbar.

18 September 2026
KI & lokale LLMs

WordPress: KI benutzen, um eigene Blöcke zu bauen (kostenloses Akkordeon-Beispiel)

Ein kostenloses Copy-paste-Akkordeon für WordPress — reines HTML und CSS, kein Plugin, kein JavaScript — plus der genaue KI-Prompt, der es geschrieben hat.

12 März 2025 · Aktualisiert 16 September 2026
KI & lokale LLMs

Einen Chatbot ins öffentliche Web stellen — auf eigener Hardware

Ein Chatbot auf einer öffentlichen Website, aber das Gehirn ist ein kleines Modell, das auf einem Computer bei mir zu Hause läuft — kostenlos pro Token und privat. Hier ist die Relay-Architektur, die das sicher macht, die Sicherheitslücken, die ich schließen musste, und eine ehrliche Bilanz, wie langsam es ist und was noch für Produktionsreife fehlt.

11 Juli 2026 · Aktualisiert 16 September 2026
KI & lokale LLMs

LLM-Assistenten einrichten: Claude Code, Cowork, Terminex und DeepSeek

Der Sammel-Guide, auf den jede "Selbst umsetzen?"-Box auf dieser Seite verweist: was ein agentischer LLM-Assistent überhaupt ist, und vier echte Wege, noch heute einen zum Laufen zu bringen.

11 Juli 2026 · Aktualisiert 16 September 2026
KI & lokale LLMs

OpenClaw kaputt? Ich repariere es mit Claude Code

Meine zweistufige Reparaturstrategie: OpenClaw-Agenten erledigen die Routinearbeit, und wenn wirklich etwas kaputtgeht, repariert Claude Code die Maschine — und bringt OpenClaw anschließend bei, es beim nächsten Mal selbst zu schaffen.

11 Juli 2026 · Aktualisiert 16 September 2026
KI & lokale LLMs

MiniMax M3: Ein OpenClaw-Coding-Agent im Vergleich zu Kimi K3 und dsh

MiniMax M3 bewältigte auf OpenClaws eigenem Agenten-Loop fünf kleine Coding-Aufgaben in 159 s, gegenüber 310 s bei Kimi K3 (Kimi mit maximaler Denkleistung, andere Fixtures), zu einem Viertel der Listenpreiskosten. Das Widget, das ich zunächst ihm zuschrieb, stammte von Kimi.

12 September 2026 · Aktualisiert 16 September 2026
KI & lokale LLMs

Lokale KI-Bildgenerierung auf AMD (ROCm): ComfyUI + Z-Image Turbo

Wie ich aus einem AMD Strix Halo-Computer einen lokalen KI-Bildgenerator gemacht habe – ComfyUI und Z-Image Turbo laufen dabei als systemd-Dienst. Ohne Cloud-Konto dauert die Erstellung eines 1024px-Bildes etwa 27 Sekunden.

11 Juli 2026 · Aktualisiert 16 September 2026
KI & lokale LLMs

Kimi K3 in OpenClaw im Vergleich zu dsh: 5/5 Aufgaben, 9× langsamer, 48× höhere Kosten

Moonshots Kimi K3 steuert die Agenten-Schleife von OpenClaw bei fünf kleinen Programmieraufgaben: Alle 5 Aufgaben wurden erfolgreich gelöst. Allerdings ist der Prozess etwa 9× langsamer und 48× kostspieliger als bei Einsatz von dsh auf DeepSeek V4-Flash – im Vergleich zum „kalten“ Durchlauf sogar 22× teurer. Für die Erstellung des Pixel-Art-Widgets waren drei Versuche nötig.

12 September 2026 · Aktualisiert 16 September 2026
KI & lokale LLMs

InfoForge: Offline-Wikipedia als RAG-Quelle für meine lokalen KI-Agenten

Die gesamte englischsprachige Wikipedia – 19,19 Millionen Einträge, 52,69 GB, kein Internet – steht hinter einem lokalen Suchindex, den meine KI-Agenten abfragen können. Jede Antwort zitiert ihre Artikel, und wenn keine gefunden werden kann, sagt sie das, anstatt zu raten.

28 August 2026 · Aktualisiert 16 September 2026
KI & lokale LLMs

Wie ich OMLA gebaut habe, indem ich KI-Agenten dirigiert habe, statt selbst zu coden

Ein Typ, kein Backend-Team: Ich habe KI-Coding-Agenten dirigiert, um eine echte Lizenzierungsplattform für Tantiemen für eine gemeinnützige Organisation zu bauen, inklusive Audits und Gated Deploy. Der tatsächliche Prozess, nicht die Highlight-Reel-Version.

11 Juli 2026 · Aktualisiert 16 September 2026
KI & lokale LLMs

Wie du ein LLM jedes Projekt an dein System anpassen lässt

Das allgemeine Rezept, mit dem du jedes offene Projekt — ein GitHub-Repo oder ein Zip von dieser Seite — von einem KI-Assistenten auf deinem Rechner zum Laufen bringen lässt, auch wenn du selbst nicht programmierst.

11 Juli 2026 · Aktualisiert 16 September 2026
KI & lokale LLMs

Ich habe meiner Familie eine Reiseplan-App gebaut — mit einem KI-Assistenten darin

Eine private, PIN-gesicherte Reiseplan-Webapp für eine Familienreise nach Japan — Tag-für-Tag-Pläne, Live-Wetter, Offline-Unterstützung und ein eingebauter KI-Assistent, der Fragen beantworten und kleine Änderungen vornehmen kann. So ist sie entstanden, mit allen Fallstricken, inklusive einer bereinigten Beispieldatei zum Herunterladen.

11 Juli 2026 · Aktualisiert 16 September 2026
KI & lokale LLMs

DeepSeek: Lokal betreiben — eine Anleitung in 4 Schritten (keine Vorkenntnisse nötig)

Eine Anleitung in vier Schritten, um DeepSeek auf dem eigenen PC mit Ollama, Docker und Open WebUI zu betreiben. Kein Cloud-Konto, kein Abo — nur eine Grafikkarte mit 8 GB vRAM.

11 Februar 2025 · Aktualisiert 16 September 2026
KI & lokale LLMs

DeepSeek überall: Claude Code und ein lokaler Agenten-Stack

Im Juli 2026 hat DeepSeek unauffällig sowohl meinen Agenten-Stack zuhause als auch Claude Code unterstützt. Hier sind die drei copy-paste-fertigen Verdrahtungsmuster, inklusive des systemd-Tricks, der den API-Schlüssel komplett aus argv heraushält.

11 Juli 2026 · Aktualisiert 16 September 2026
KI & lokale LLMs

Mein KI-Agent hat ein Benchmarking-Tool für meine KI-Agenten entwickelt.

Mein Coding-Agent hat „bench-llm“ geschrieben – ein Programm mit 1.660 Zeilen Python-Code, das lokale Modelle in LM Studio bewertet. Innerhalb von zwei Wochen erzielten alle meine Modelle eine Bewertung von 5/5; daher ersetzte ich „bench-llm“ durch CrucibleForge: 251 Testfälle, davon 158 schwierige – mittlerweile auf GitHub verfügbar.

11 August 2026 · Aktualisiert 16 September 2026
KI & lokale LLMs

Pixel-Art-Widget-Showdown: Drei Codierungsagenten, ein Auftrag, zwei Autoren

Ich gab dsh, Kimi K3 und MiniMax M3 denselben Auftrag: ein Pixel-Art-LaserLloyd-Logo-Widget zu erstellen. dsh und Kimi entwickelten funktionierende Widgets. MiniMax antwortete, es habe ebenfalls eines erstellt – doch die angegebenen Dateien gehörten zu Kimis Arbeit.

12 September 2026 · Aktualisiert 12 September 2026
KI & lokale LLMs

Mein OpenClaw-Setup: Eine Box, die Websites bauen kann

Ein Linux-Mini-PC betreibt OpenClaw-Agenten, die meine Websites über eine abgesicherte, mit Backups versehene Deploy-Pipeline schreiben, bauen und veröffentlichen — jeder Deploy macht zuerst einen Dry-Run, sichert den Server und wartet auf meine Freigabe.

31 Juli 2026 · Aktualisiert 26 August 2026
KI & lokale LLMs

Acht KI-Agenten, eine AMD-Kiste: Mein lokaler Agenten-Stack (OpenClaw)

Acht KI-Agenten mit Namen leben auf einem Mini-PC bei mir zu Hause — ein Dispatcher, ein harter Denker, ein lokales Arbeitstier, ein Vision-Bot — wobei DeepSeeks günstige API die Schwerarbeit für etwa 24 $ im Monat übernimmt.

11 Juli 2026 · Aktualisiert 26 August 2026
KI & lokale LLMs

DeepSeek Harness (dsh): Ich habe DeepSeeks Open-Source-Coding-Agent installiert, in meine Chat-App eingebunden und einem Benchmark unterzogen

DeepSeek hat am 13. August einen unter MIT-Lizenz veröffentlichten Coding-Agenten herausgebracht. Fünf Tage später läuft er auf meinem Bluefin-Rechner als systemd-Dienst, sitzt neben Reasonix in DisPatch und hat 15/15 Aufgaben auf drei Modellen bestanden – darunter einem lokalen. Setup, Zahlen, Stolperfallen.

18 August 2026 · Aktualisiert 26 August 2026
KI & lokale LLMs

Die CHUWI AuBox Ai365: mein KI-Home-Lab in einer Box

Ein wenig bekannter Strix-Point-Mini-PC mit doppeltem 2,5GbE, USB4 und einem Ryzen AI 9 365 — läuft mit Bluefin Linux, hostet acht KI-Agenten und zieht am Chip unter 5 W. Er hat ein totes 128-GB-Tablet ersetzt, und dieser Beitrag wird aktualisiert, sobald sich an der Box etwas ändert.

1 August 2026 · Aktualisiert 26 August 2026
KI & lokale LLMs

Reasonix: Ein Codierungs-Agent im Stil von Claude Code auf DeepSeek

Ein Terminal-Coding-Agent, der ähnlich wie Claude Code funktioniert – mit Subagenten, Fähigkeiten sowie Projektspeicher – doch nutzt er stattdessen die Pay-per-Token-API von DeepSeek anstelle eines Abonnements. Es gibt eine einfache Einrichtung, verschiedene Modellstufen sowie einen automatischen Updater, der im Hintergrund arbeitet.

11 Juli 2026 · Aktualisiert 1 August 2026
KI & lokale LLMs

Das ASUS ROG Flow Z13: mein tragbares Home Lab, das partout nicht tragbar bleiben wollte

Ein 128-GB-Gaming-Tablet betrieb meine KI-Agenten, meine Websites und mein gesamtes Heimnetzwerk — bis ein Stromfehler es bei jedem Einschalten nach 30 Sekunden in den Schlafmodus schickte. Hier ist die vollständige Obduktion.

30 Juli 2026 · Aktualisiert 1 August 2026
KI & lokale LLMs

WordPress zu Static mit Claude Code: Wie ich diese Seite an einem Nachmittag neu gebaut habe

Diese Seite lief früher auf WordPress. Ein KI-Coding-Agent hat sie an einem Nachmittag als Markdown-Dateien plus einen 183-Zeilen-Python-Generator neu gebaut — und derselbe Workflow pflegt sie bis heute.

11 Juli 2026
KI & lokale LLMs

Headless ComfyUI: Als Dienst betreiben, von überall nutzen

Die Fortsetzung zu meinem AMD-ComfyUI-Aufbau: headless als systemd-Dienst betreiben, per HTTP-API aus Skripten heraus steuern und die Browser-UI sicher von jedem Gerät aus nutzen — während jeder Workflow weiterhin auf der Box gespeichert wird.

11 Juli 2026 · Aktualisiert 11 Juli 2026
KI & lokale LLMs

KI-Koch: Ein kostenloser System-Prompt für die wöchentliche Essensplanung

Ein einziger Copy-Paste-System-Prompt verwandelt eine Chat-KI in ProChef: wöchentliche Abendessenpläne, echte Rezepte und eine Einkaufsliste, die bereits nach Abteilungen im Supermarkt sortiert ist. Läuft auf meinem lokalen Ollama-System – aber normales ChatGPT funktioniert auch.

19 Dezember 2024