Selfhosting

Mnemosyne für den Hermes-Agenten: Schnellstart für lokale Erinnerungen

Mnemosyne für den Hermes-Agenten: Schnellstart für lokale Erinnerungen

Lokaler Hermes-Speicher mit kontrollierten Schreibvorgängen.

Mnemosyne ist ein lokalzenterter Gedächtnisanbieter für den Hermes Agent, der Arbeitsgedächtnis, strukturierte Fakten, zeitliche Daten und episodische Verläufe in lokalen SQLite-Datenbanken speichert – ohne gehosteten Service, ohne zwingende Netzwerkaufrufe und mit ungewöhnlich granularer Steuermöglichkeit beim Schreiben.

Selbstverstärkende Gedächtnisschleifen in KI-Agenten: Ursachen und Lösungen

Selbstverstärkende Gedächtnisschleifen in KI-Agenten: Ursachen und Lösungen

„Wenn erinnerte Schlüsse zu neuen Belegen werden.“

Persistenter Speicher verwandelt einen Agenten aus einem Werkzeug, das bei jedem neuen Dialog seine Kontextinformationen erklären muss, in ein System, das Kontext über die Zeit trägt – aber er öffnet dabei einen Fehlzustand, den stateless Chat vermeidet: Eine Interpretation kann zum Gedächtnisinhalt werden, als Fakt abgerufen werden und eine stärkere Version von sich selbst rechtfertigen.

So migrieren Sie sicher von OpenClaw auf Hermes Agent

So migrieren Sie sicher von OpenClaw auf Hermes Agent

Ein sicheres Cutover jenseits des einzeiligen Imports

Die Migration eines KI-Assistenten unterscheidet sich grundlegend vom einfachen Kopieren einer Anwendungs-Konfiguration. Die eigentliche Herausforderung besteht darin, Identität, Gedächtnis, Tool-Verhalten, geplante Aufgaben und den Messaging-Zugriff so zu erhalten, dass nicht zwei Gateways als derselbe Bot agieren.

KV-Cache auf 16-GB-GPUs: Lange Kontexte wirklich unterbringen

KV-Cache auf 16-GB-GPUs: Lange Kontexte wirklich unterbringen

Warum 128K Kontext auf 16 GB scheitert

Ein Modell kann einen 128K-Kontextfenster bewerben und trotzdem bei 40K Tokens auf einer 16-GB-GPU scheitern. Die architektonische Obergrenze hat nie versprochen, dass Modellgewichte, KV-Cache, Rechenspeicher und der Desktop-Compositor gleichzeitig auf Ihrer Grafikkarte Platz finden würden.

Datenschwere: Die wahren Kosten von API-First-KI

Datenschwere: Die wahren Kosten von API-First-KI

Warum Ihr KI-Stack jeden Monat anhaltender wird.

Jeder API-Aufruf fühlt sich an wie eine einfache Transaktion – bis sich genügend davon ansammeln, dass Ihre Feinabigungsdaten, Evaluierungs-Tools und Tool-Schemas alle um einen einzigen Anbieter herum geformt sind und ein Wechsel nicht mehr nur eine Routing-Änderung ist.

GPUs für KI im Jahr 2026: NVIDIA, AMD und Intel im Vergleich

GPUs für KI im Jahr 2026: NVIDIA, AMD und Intel im Vergleich

Vergleich von AI-GPUs dreier Anbieter

Die Landschaft der KI-Hardware hat sich 2026 erheblich verändert. NVIDIA, AMD und Intel konkurrieren alle um Entwickler, die GPUs benötigen, die in der Lage sind, lokale Large Language Models (LLMs) und KI-Inferenz-Arbeitslasten auszuführen.

Hermes-Agent: Headless-Server + Remote-Desktop-Einrichtung

Hermes-Agent: Headless-Server + Remote-Desktop-Einrichtung

Headless Hermes-Server mit Remote-Desktop-Zugriff

Das Ausführen des Hermes-Agenten auf einem headless-Server bei gleichzeitiger Verbindung von einem Desktop-Client auf einer anderen Maschine erfordert zwei Serverprozesse und eine einzelne Client-Verbindung.

Docker Compose als Linux-Dienst mit systemd ausführen

Docker Compose als Linux-Dienst mit systemd ausführen

Docker Compose beim Systemstart, verwaltet durch systemd.

Ein Docker Compose-Projekt auf einem Linux-Server sollte beim Booten starten, beim Herunterfahren sauber gestoppt werden und Neustarts ohne manuelle Eingriffe überstehen.

Speichersysteme in KI-Assistenten

Speichersysteme in KI-Assistenten

Arbeits-, strukturiertes und Abrufgedächtnis für Assistenten.

Speicher wandelt Assistenten von reaktiv in persistent um, aber genau dort verrotten auch viele Systeme still vor sich hin. Umfragen zeigen, dass die Trennung in Kurzzeit- und Langzeitgedächtnis für modernes Agenten-Gedächtnis nicht mehr ausreicht; OpenAI und LangGraph-SDKs deuten auf einen simpleren Stack hin — Arbeitsgedächtnis, dauerhafter Zustand und Abruf (Retrieval).