Hermes Agent: Was er ist, was er nicht ist und wann Sie ihn einsetzen sollten
Mittelstufe7 Min. LesezeitAutomatisierungen

Hermes Agent: Was er ist, was er nicht ist und wann Sie ihn einsetzen sollten

Ein klarer Überblick über Hermes Agent von Nous Research: persistentes Gedächtnis, Skills, Tools und Messaging-Gateways sowie eine Entscheidungshilfe, wann ein Chatbot ausreicht und wann eine Agent-Runtime das richtige Werkzeug ist.

Das sollten Sie danach können

Hermes Agent ist eine Agent-Runtime mit Gedächtnis, Skills und Tools, kein besseres Chatfenster. Nutzen Sie ihn, wenn eine Aufgabe dauerhaften Kontext und kontrollierte Aktionen erfordert; bleiben Sie beim Chatbot, wenn eine einzelne Antwort genügt.

Nur in diesem Browser gespeichert.
In diesem Artikel

Die meisten Menschen begegnen KI in einem Chatfenster. Sie tippen etwas ein, erhalten eine Antwort, die Sitzung endet und am nächsten Tag beginnen Sie wieder von vorn. Für Entwürfe, Erklärungen und einmalige Recherchen ist das völlig in Ordnung. Für Aufgaben, die Ihre Präferenzen im Gedächtnis behalten, bewährte Abläufe wiederverwenden und Tools in realen Systemen aufrufen müssen, ist dieses Modell jedoch ungeeignet.

Hermes Agent ist eine quelloffene Agent-Runtime von Nous Research. Zu den dokumentierten Bedienoberflächen gehören eine CLI, eine Desktop-App, ein Messaging-Gateway und eine ACP-Editor-Integration. Die Runtime bietet persistentes Gedächtnis, wiederverwendbare Skills, Tools, Cron, Browserautomatisierung, Codeausführung und die Delegation an Sub-Agenten. Dieser Artikel erklärt, was Hermes ist, was er nicht ist und wann ein Chatbot weiterhin die bessere Wahl bleibt.

Was Hermes Agent ist

Betrachten Sie Hermes als Arbeitsumgebung rund um ein Sprachmodell, nicht als das Modell selbst.

Das Modell erzeugt weiterhin Text und Tool-Aufrufe. Hermes stellt die Ablauflogik bereit, die daraus dauerhafte Arbeitsprozesse macht:

  • Persistentes Gedächtnis über Sitzungen hinweg, darunter größenbegrenzte Dateien wie MEMORY.md und USER.md sowie optionale externe Anbieter, wie in der Gedächtnisdokumentation beschrieben.
  • Skills, verfahrensorientierte Markdown-Pakete, die der Agent für wiederkehrende Aufgaben lädt, etwa um einen PR zu triagieren oder ein wöchentliches Betriebsbriefing zu entwerfen. Skills liegen im Hermes-Skills-Verzeichnis und folgen dem in der offiziellen Skills-Dokumentation beschriebenen Modell.
  • Tools, einschließlich Terminal, Dateien, Browser, Websuche, Codeausführung, Gedächtnis, Cron und MCP-Server. Die Tools-Dokumentation beschreibt das integrierte Register und konfigurierbare Toolsets.
  • Bedienoberflächen, darunter die CLI, die Desktop-App und die ACP-Editor-Integration sowie ein separates Messaging-Gateway für Telegram, Discord, Slack und andere Kanäle.
  • Ereignis- und Zeitplan-Hooks, mit Cron für regelmäßige Prüfungen und dem Webhook-Adapter für authentifizierte Ereigniseingänge auf Standardport 8644. Webhook-Ergebnisse gehen an ein konfiguriertes Zustellziel; der Adapter ist weder der mit Bearer-Token authentifizierte API-Server noch ein generischer synchroner Callback.

Sie wählen den Modellanbieter, etwa Cloud-APIs, OpenRouter oder lokale OpenAI-kompatible Endpunkte wie Ollama und vLLM. Die aktuelle Anbieterdokumentation verlangt für den Agenteneinsatz mit Tools ein Kontextfenster von mindestens 64.000 Token. Die bloße Erreichbarkeit des Endpunkts ist daher kein ausreichender Kompatibilitätstest. Hermes ist die Runtime, die Zustand, Skills und Tool-Richtlinien um das Modell herum verwaltet.

Trennen Sie bei der Bewertung von Hermes drei Ebenen: (1) Modellqualität und Kosten, (2) die Hermes-Konfiguration von Gedächtnis, Skills und Tools, (3) den Standort und die Erreichbarkeit des Gateways. Wer diese Ebenen vermischt, erzeugt Tickets mit dem Inhalt „Der Agent ist kaputt“, obwohl die Ursache tatsächlich beim Modell, in der Konfiguration oder im Netzwerk liegt.

Was Hermes Agent nicht ist

Diese Abgrenzung verhindert kostspielige Fehlannahmen.

Kein festes Hosting-Modell. ChatGPT, Claude.ai und Gemini-Apps sind Produktoberflächen mit eigenem Gedächtnis und eigenen Konnektoren. Wenn Sie Hermes selbst hosten, tragen Sie die Verantwortung für Installation, Updates, Secrets und die Erreichbarkeit im Netzwerk. Nous Research dokumentiert außerdem Hermes Cloud, einen gehosteten Hermes Agent auf einer dedizierten Cloud-Instanz. Für diesen Dienst gelten andere Grenzen der Infrastruktur- und Datenverantwortung, die Sie separat prüfen müssen.

Kein Ersatz für Workflow-Automatisierung. Wenn die Aufgabe deterministisch ist, etwa einen Webhook zu empfangen, Felder zu validieren, eine Zeile zu schreiben und Slack zu benachrichtigen, nutzen Sie n8n, Zapier oder Make. Hermes kann Teil einer hybriden Lösung sein; er sollte aber nicht zu einem fragilen Ersatz für Konnektoren und Wiederholungslogik werden. Siehe /articles/hermes-vs-n8n-choose-by-job und /articles/n8n-vs-zapier-vs-make.

Keine magische Autonomie. Tools, die Shell-Befehle ausführen, Dateien bearbeiten oder im Web browsen können, können auch Systeme beschädigen. Hermes bietet Freigabemodi für gefährliche Befehle und bedingungslose approvals.deny-Muster. Tirith ist dagegen ein separater, vorgeschalteter Inhaltsscanner, der standardmäßig fail-open arbeitet, wenn er nicht verfügbar ist. Diese Kontrollen der Bedienerabsicht ersetzen weder Docker noch Modal oder eine andere Isolationsgrenze. Die Sicherheitsdokumentation sollte die Auswahl des Toolsets und der Sandbox bestimmen, bevor Sie reale Systeme anbinden.

Keine Garantie für „selbstverbessernde“ Spitzenleistung. Marketingformulierungen zu Lernschleifen und Skill-Erstellung beschreiben eine Fähigkeit: Der Agent kann auf Grundlage seiner Erfahrungen Skills schreiben und verfeinern. Standardmäßig sind skills.write_approval und memory.write_approval beide false; Schreibvorgänge werden also nur dann zur Freigabe vorgemerkt, wenn Sie diese Prüfstellen aktivieren. Die Qualität hängt weiterhin von Reviews und einer sorgfältigen Gedächtnispflege ab. Behandeln Sie neue Skills wie ungeprüfte Pull Requests. Eine Scanner- oder Katalogprüfung macht Anweisungen Dritter nicht vertrauenswürdig.

Keine Therapie, keine Rechtsberatung, keine medizinische Beratung. Hier gilt dieselbe Regel wie bei jedem anderen LLM-Produkt: Professionelle Bereiche, die fundierte Urteile erfordern, brauchen entsprechend qualifizierte Fachleute. Hermes verschiebt diese Grenze nicht.

Chatbot vs. Agent-Runtime: eine Entscheidungsregel

Nutzen Sie einen Chatbot, wenn:

  • Eine Antwort oder ein Entwurf ausreicht.
  • Sie das Ergebnis selbst in das reale System einfügen.
  • Kein sitzungsübergreifendes Gedächtnis nötig ist, über das hinaus, was das Produkt bereits bietet.
  • Die Kosten eines Fehlers niedrig sind (falscher Entwurf, neu schreiben).

Nutzen Sie eine Agent-Runtime wie Hermes, wenn:

  • Die Arbeit sich wiederholt und ein Verfahren in einem Skill abgebildet werden sollte statt nur in einem einmaligen Prompt.
  • Kontext bestehen muss: Projektkonventionen, bevorzugter Ton, Repo-Layout, wiederkehrende Kunden.
  • Der nächste Schritt Tools braucht: das Repo durchsuchen, eine Seite öffnen, ein Skript ausführen, ein Issue erstellen.
  • Das Ergebnis dort zugestellt werden soll, wo das Team bereits arbeitet (Telegram/Slack/CLI), nicht nur in einem Browser-Chat.
  • Sie ereignisgesteuerte Läufe per Webhook oder regelmäßige Prüfungen per Cron brauchen.

Ein kompakter Test: Wenn der Nutzen endet, sobald der Text erscheint, verwenden Sie einen Chatbot. Wenn der eigentliche Wert im Erinnern, Entscheiden, Handeln und Aufbewahren der konfigurierten Betriebsprotokolle liegt, prüfen Sie eine Agent-Runtime. Sitzungs-, Gateway- und Zustellprotokolle müssen konfiguriert und getestet sein, bevor jemand sie als Audit-Trail bezeichnet.

AufgabeBevorzugte LösungWarum
Eine schwierige E-Mail einmal umschreibenChatbotEinzelne Ausgabe, Mensch versendet sie
Wöchentliche Support-Triage nach derselben ChecklisteHermes + SkillVerfahren + Gedächtnis + Kanalzustellung
Formular immer wieder auf CRM-Felder abbildenn8n / Zapier / MakeDeterministische Verknüpfung
PR geöffnet: Risikoübersicht und PrüfschritteHermes-Webhook-RouteEreignis + Urteil; Zustellung an festgelegtes Ziel
Lange private Korpusabfrage mit QuellenprüfungHermes oder RAG-Stack auf lokalen/privaten ModellenPersistenz + Tools; Aussagen weiterhin prüfen

Gedächtnis, Skills und Tools: das nützliche mentale Modell

Denken Sie an drei Speicherbereiche:

  1. Gedächtnis: Fakten über Sie, die Umgebung und dauerhafte Präferenzen (USER.md, MEMORY.md, optionale Anbieter). Gut für „wir nutzen Linear, estnische Kunden bevorzugen formellen Ton, nie auf main pushen.“ Schlecht für das Ablegen ganzer Tickets und Secrets.

  2. Skills: wie eine bestimmte Art von Aufgabe erledigt wird. Gut für „beim Zusammenfassen eines PR immer Auswirkungsradius, fehlende Tests und Rollout-Risiko auflisten“. Schlecht für einmalige Prompts, die Sie nie wiederverwenden.

  3. Tools: worauf der Agent zugreifen darf. Gut für „zuerst nur lesend auf GitHub suchen; Schreibaktionen brauchen eine Freigabe“. Schlecht für „alles freischalten, damit es leistungsfähig wirkt“.

Persistentes Gedächtnis und Tool-Zugriff bedeuten, dass Hermes personenbezogene Daten, Kundenausschnitte und Verweise auf Zugangsdaten über Sitzungen hinweg behalten kann. Fügen Sie Secrets nicht „der Bequemlichkeit wegen“ in den Chat ein. Umgebungsdateien konfigurieren Prozesse; sie bilden keine Isolationsgrenze für Secrets. Nutzen Sie eng begrenzte Tokens, die standardmäßige Secret-Redaktion, eingeschränkte Toolsets und eine zum Bedrohungsmodell passende Sandbox, bevor Sie E-Mail, CRM oder Produktiv-Shells anbinden.

Ein konkretes Szenario

Support-Posteingang, kleines B2B-Team. Heute fügt jemand Tickets in ChatGPT ein, erhält einen Entwurf und kopiert ihn in das Helpdesk. Ein denkbarer Hermes-Ablauf würde einen Webhook oder eine Kanalnachricht mit einem auf die nötigen Daten reduzierten Ticket-Payload annehmen, einen Triage-Skill laden, kuratierte Produkt- und Schweregradangaben verwenden und zulässige Quellen durchsuchen. Der Entwurf würde an einen unterstützten, konfigurierten Prüfkanal gehen und nicht automatisch versendet. Wenn n8n das Ergebnis innerhalb desselben Workflows benötigt, sollte es den mit Bearer-Token authentifizierten API-Server auf Standardport 8642 aufrufen, statt anzunehmen, dass der Webhook-Adapter die Agentenausgabe zurückgibt.

Unter beiden Abläufen kann dasselbe Modell arbeiten. Der Unterschied liegt in Persistenz, Verfahren und kontrolliertem Handeln. In diese Produktkategorie gehört Hermes.

Wann Sie nicht mit Hermes starten sollten

Überspringen oder verschieben Sie Hermes, wenn:

  • Niemand im Team ein selbst gehostetes Gateway warten kann (Updates, Backups, Firewall, Secrets).
  • Der erste Anwendungsfall noch „Fragen zu KI stellen“ ohne Tool-Bedarf ist.
  • Sie kurzfristig geprüfte SaaS-Konnektoren und Compliance-Unterlagen brauchen; dann kann zunächst eine etablierte Automatisierungsplattform besser passen.
  • Die Führung in der ersten Woche unbeaufsichtigte Schreibvorgänge in Produktivsystemen erwartet. Damit ist ein Betriebsvorfall vorprogrammiert, unabhängig vom Produkt.

Starten Sie mit Hermes, wenn Sie den Zusatzaufwand eines reinen Chat-Workflows bereits spüren: Sie müssen in jeder Sitzung den Kontext neu erklären, dasselbe Verfahren immer wieder kopieren oder möchten Agenten in Telegram beziehungsweise Slack mit einer echten Tool-Grenze einsetzen.

Übung: klassifizieren Sie fünf Aufgaben auf Ihrem Schreibtisch

Listen Sie fünf wiederkehrende KI-bezogene Aufgaben der letzten zwei Wochen auf. Markieren Sie für jede:

  1. Chatbot / Hermes / Automatisierungsplattform / Hybrid
  2. Braucht Gedächtnis? (ja/nein)
  3. Braucht einen Skill? (ja/nein)
  4. Braucht ein Tool mit Nebenwirkungen? (ja/nein)
  5. Mensch muss vor externem Senden/Schreiben freigeben? (ja/nein)

Als Übungsheuristik gilt: Wenn drei oder mehr Zeilen Gedächtnis und ein wiederverwendbares Verfahren und ein Tool erfordern, kann sich ein kontrollierter Pilot mit Hermes oder einer ähnlichen Agent-Runtime lohnen. Diese Schwelle ist keine validierte Auswahlregel. Wenn fast alles auf „einmal entwerfen, dann füge ich es selbst ein“ hinausläuft, bleiben Sie beim Chatbot und investieren Sie stattdessen in eine Prompt-Bibliothek (/articles/reusable-prompt-libraries).

Wohin als Nächstes

  • Einrichtung in der ersten Woche, Gedächtnishygiene, Skills und Shell-Freigaben: Die erste Woche mit Hermes Agent: Gedächtnishygiene, Skills und Tool-Freigaben
  • Ereignisgesteuerte Routen und anbietergerechte Authentifizierung: Hermes-Webhooks für ereignisgesteuerte Agenten ohne überladenen Sammelprompt
  • Hermes vs. n8n nach Aufgabe wählen: /articles/hermes-vs-n8n-choose-by-job
  • Offizielle Installation und Dokumentation: Quickstart, Dokumentation, GitHub

Hermes Agent ist nützlich, wenn Sie einen Agenten brauchen, der seinen Zustand bewahrt und innerhalb festgelegter Richtlinien handelt. Er ist unnötiger Mehraufwand, wenn eine einzelne Chat-Antwort die gesamte Aufgabe erledigt. Entscheiden Sie nach der Art der Arbeit, nicht nach der Neuheit des Stacks.

Weiterlesen

Fahren Sie mit demselben Lernpfad fort und lesen Sie die nächsten praktischen Artikel.

Thema vertiefen

Sorgfältig ausgewählte externe Kurse, die dieses Thema vertiefen.

Alle Kurse für Automatisierungen ansehen