Zum Hauptinhalt springen
20 min

KI-Agenten auf dem eigenen Server erstellen: Hermes Agent

Wie du den Open-Source-KI-Agenten Hermes auf einem eigenen Linux-Server installierst, mit Discord verbindest und DSGVO-konform betreibst – Schritt für Schritt.

KI-Agenten auf dem eigenen Server erstellen: Hermes Agent

Das Wichtigste in Kürze (TL;DR)

  • Was ist Hermes? Ein Open-Source-KI-Agent, den du auf deinem eigenen Server betreibst – mit persistentem Gedächtnis, 31 Tools und 68 Skills, erreichbar über Discord oder Matrix.
  • Warum selbst hosten? Deine Daten verlassen nie deine eigene Infrastruktur – volle Kontrolle über Modelle, Zugriffe und Verhalten.
  • DSGVO-konform wird das Setup durch: Self-Hosting (Hermes + Firecrawl), EU-Server (Hetzner Deutschland), innoGPT als EU-API statt OpenAI und Matrix/Element statt Discord.
  • In wenigen Stunden startklar: Cloudserver anlegen → per SSH absichern → Docker + Firecrawl → Hermes installieren → mit Discord verbinden → als Dauerdienst einrichten.
  • Kosten: Server ab ca. 19 € pro Monat; die eigentlichen Kosten entstehen durch die KI-Modell-API – mit einem Monatslimit deckelbar.
  • Für wen? Technisch versierte Nutzer, die einen anpassbaren 24/7-Agenten unter eigener Kontrolle wollen – als produktives Experiment, nicht als fertiges Enterprise-System.

Was wäre, wenn dein KI-Assistent nicht auf fremden Servern läuft?

Was wäre, wenn dein persönlicher KI-Assistent nicht auf den Servern eines amerikanischen Anbieters läuft, sondern auf deiner eigenen Infrastruktur – 24 Stunden am Tag, 7 Tage die Woche, vollständig unter deiner Kontrolle? Genau das ermöglicht Hermes Agent: Ein leistungsstarker, selbst gehosteter KI-Agent, den du mit einem Cloudserver dauerhaft betreiben kannst. Er chattet mit dir über Discord oder Matrix, durchsucht Webseiten mit einem eigenen Firecrawl-Server und antwortet mit den Modellen deiner Wahl.

In diesem Praxis-Guide zeigen wir dir Schritt für Schritt, wie du einen Server bei Hetzner oder Hostinger einrichtest, Hermes darauf installierst, mit Discord verbindest und dauerhaft automatisch starten lässt – inklusive klarem DSGVO-Check für jede Komponente.


Was ist der Hermes Agent überhaupt?

Hermes ist ein Open-Source-KI-Agent von Nous Research, der auf deinem eigenen Server läuft und über verschiedene Messaging-Dienste wie Discord, Telegram oder Matrix angesprochen werden kann. Das Besondere: Er unterstützt sogenannte Toolsets – Erweiterungen wie Web-Suche, Dateiverarbeitung oder Webscraping über Firecrawl.

Im Gegensatz zu klassischen KI-Chatbots ist Hermes kein passiver Assistent, sondern ein aktiver Agent, der eigenständig Aufgaben ausführt, Webseiten analysiert und komplexe Aufgaben abarbeitet. Mit 31 verfügbaren Tools und 68 Skills – von Browser-Automatisierung über Code-Ausführung bis hin zu Discord-Integration – ist er ein vollwertiges Produktivitätswerkzeug.

Was Hermes von den meisten anderen Agenten unterscheidet: ein persistierendes Gedächtnis. Hermes merkt sich Kontext über einzelne Gespräche hinaus – er weiß beim nächsten Chat noch, was du zuletzt besprochen hast, welche Aufgaben er ausgeführt hat und welche Präferenzen du hast. Dieses Gedächtnis liegt vollständig auf deinem Server (unter ~/.hermes/sessions/ und ~/.hermes/memory/) und bleibt auch nach einem Neustart erhalten. Das macht Hermes zu einem echten persönlichen Assistenten, der mit der Zeit besser wird – und nicht zu einem zustandslosen Chatbot, der jeden Dialog von vorne beginnt.

Hermes Agent v0.16.0 mit allen verfügbaren Tools und Skills Hermes Agent v0.16.0 – übersichtlich aufgelistet sind alle verfügbaren Tools und Skills, von Browser-Automatisierung bis hin zu Discord und Cron-Jobs.


Warum ein eigener Server?

Der entscheidende Vorteil des Self-Hostings liegt auf der Hand: Deine Daten verlassen niemals deine eigene Infrastruktur. Du hast die volle Kontrolle darüber, wer Zugriff auf den Agenten hat, welche Modelle er nutzt und wie er sich verhält. Hinzu kommt, dass Erweiterungen wie Firecrawl – das Self-Hosted-Webscraping-Tool – auf demselben Server laufen und damit vollständig kostenlos und ohne API-Limits nutzbar sind.

Ein einfacher Cloudserver der Einstiegsklasse mit 2 vCPUs und 4 GB RAM reicht völlig aus, um Hermes und Firecrawl parallel zu betreiben.


DSGVO-Check: Welche Komponenten sind konform?

Der Self-Hosting-Ansatz von Hermes ist die Grundlage für DSGVO-Konformität – aber nicht alle Komponenten des Stacks sind automatisch datenschutzkonform. Hier der ehrliche Überblick:

✅ Hermes selbst (selbst gehostet)

Alle Konversationen, Logs und der Agenten-Speicher liegen ausschließlich auf deinem Server. Kein Telemetrie, kein Cloud-Sync, keine Datenübertragung an Nous Research. DSGVO-Anforderungen wie Löschrecht und Auskunft lassen sich direkt erfüllen.

✅ Firecrawl (selbst gehostet)

In der Self-Hosted-Variante läuft Firecrawl als Docker-Container auf deinem Server. Gescrapte Webseiteninhalte verlassen deine Infrastruktur nie. Vollständig DSGVO-konform.

⚠️ Discord als Messaging-Interface

Discord ist ein US-amerikanischer Dienst. Nachrichten, die du über Discord an deinen Bot sendest, passieren Discord-Server – und damit möglicherweise US-Rechenzentren. Für den privaten Gebrauch oder interne Experimente vertretbar, für den produktiven Unternehmenseinsatz mit Personendaten jedoch problematisch.

DSGVO-konforme Alternative: Hermes unterstützt auch Telegram und – über Community-Integrationen – Matrix/Element. Matrix ist vollständig selbst hostbar (z. B. via Synapse) und damit die sauberste Lösung für Unternehmensumgebungen. Wire und Mattermost sind weitere selbst hostbare Optionen.

⚠️ KI-Modell-API (OpenAI, Anthropic, etc.)

Wenn Hermes Anfragen an die API von OpenAI oder Anthropic sendet, verlassen deine Prompts und Kontextdaten den eigenen Server. Beide Anbieter haben ihren Hauptsitz in den USA.

DSGVO-konforme Alternative: Verwende innoGPT als OpenAI-kompatiblen API-Endpunkt – EU-gehostet, DSGVO-konform, mit Verarbeitungsvertrag. Hermes unterstützt jeden OpenAI-kompatiblen Endpunkt. Setze einfach in deiner .env-Datei:

OPENAI_BASE_URL=https://app.innogpt.de/api/ext/v1
OPENAI_API_KEY=DEIN_INNOGPT_API_KEY

Alternativ: Lokale Modelle via Ollama auf demselben Server – dann verlässt keine einzige Anfrage die eigene Maschine.

ℹ️ EU AI Act ab 02.08.2026

Ab August 2026 gelten für KI-Systeme mit bestimmten Risikoklassen erweiterte Dokumentations- und Transparenzpflichten. Hermes liefert derzeit kein dediziertes Audit-Logging. Wer auf der sicheren Seite sein will, sollte Konversationslogs manuell sichern und dokumentieren.

Empfehlung für Unternehmen: Hermes + innoGPT als Modell-Backend + selbst gehostetes Matrix für Messaging = vollständig DSGVO-konformer Stack ohne US-Datenabfluss.


Schritt 1: Einen Cloudserver anlegen

Bevor du irgendetwas installierst, brauchst du einen Linux-Server. Für Hermes empfehlen sich zwei Anbieter mit Rechenzentren in Deutschland oder der EU:

Option A: Hetzner Cloud (empfohlen für DSGVO)

Hetzner betreibt seine Rechenzentren ausschließlich in Deutschland und Finnland und ist damit die erste Wahl für DSGVO-konformes Self-Hosting.

  1. Registriere dich unter hetzner.com/cloud und lege ein neues Projekt an.
  2. Klicke auf „Server erstellen" und wähle folgende Einstellungen:
    • Standort: Nürnberg oder Falkenstein (Deutschland)
    • Image: Ubuntu 24.04 LTS
    • Typ: CX22 (2 vCPUs, 4 GB RAM) – reicht für Hermes + Firecrawl; CX32 (4 vCPUs, 8 GB RAM) für mehr Komfort
  3. Füge unter „SSH-Keys" deinen öffentlichen SSH-Schlüssel ein (empfohlen) oder notiere das Root-Passwort.
  4. Klicke auf „Server kaufen" – der Server ist in etwa 30 Sekunden bereit.
  5. Notiere dir die angezeigte IP-Adresse.

Option B: Hostinger VPS

Hostinger ist günstiger und bietet ebenfalls europäische Rechenzentren (Polen, Niederlande, Großbritannien).

  1. Registriere dich unter hostinger.com und wähle „VPS Hosting".
  2. Wähle den Plan KVM 2 (2 vCPUs, 8 GB RAM) oder höher.
  3. Wähle als Betriebssystem: Ubuntu 24.04 LTS.
  4. Wähle als Rechenzentrum: Amsterdam oder Warsaw für EU-Hosting.
  5. Nach Abschluss der Bestellung findest du IP-Adresse und Root-Passwort im Hostinger-Dashboard unter „VPS" → „Verwalten".

Praxistipp: Wähle immer Ubuntu 24.04 LTS als Betriebssystem. Alle Befehle in diesem Guide sind für Ubuntu getestet. Debian funktioniert ebenfalls, andere Distributionen ggf. nicht ohne Anpassungen.


Schritt 2: Per SSH mit dem Server verbinden

Öffne auf deinem Mac oder Windows-PC ein Terminal (Mac: Terminal-App, Windows: PowerShell oder Windows Terminal) und verbinde dich mit deiner Server-IP:

ssh root@DEINE-SERVER-IP

Beim ersten Verbinden erscheint eine Sicherheitsabfrage. Bestätige mit yes. Falls du ein Passwort gesetzt hast, gib es jetzt ein.

Du siehst jetzt das Ubuntu-Terminal deines Servers – erkennbar am root@ in der Eingabezeile.


Schritt 3: System aktualisieren und absichern

Bevor du irgendetwas installierst, aktualisiere das System und lege einen dedizierten Benutzer an. Hermes sollte niemals als Root laufen.

System auf den neuesten Stand bringen:

apt update && apt upgrade -y

Dedizierten Benutzer „hermes" anlegen:

adduser hermes

Du wirst nach einem Passwort und optionalen Infos gefragt. Nur das Passwort ist Pflicht, der Rest kann mit Enter übersprungen werden.

Den neuen Benutzer zur sudo-Gruppe hinzufügen (damit er bei Bedarf Admin-Befehle ausführen kann):

usermod -aG sudo hermes

Firewall einrichten (nur SSH und notwendige Ports freigeben):

ufw allow OpenSSH
ufw enable

Bestätige mit y. Deine SSH-Verbindung bleibt dabei aktiv.

Sicherheitstipp: Wenn du SSH-Keys statt Passwörter verwendest (von Hetzner empfohlen), kannst du Passwort-Login komplett deaktivieren: nano /etc/ssh/sshd_configPasswordAuthentication nosystemctl restart ssh. Das schützt vor automatisierten Brute-Force-Angriffen.


Schritt 4: Docker installieren

Docker wird für Firecrawl benötigt. Installiere es mit folgenden Befehlen:

apt install -y docker.io docker-compose-plugin

Docker beim Systemstart automatisch starten:

systemctl enable --now docker

Den hermes-Benutzer zur Docker-Gruppe hinzufügen (damit er Docker ohne sudo nutzen kann):

usermod -aG docker hermes

Installation prüfen:

docker --version

Die Ausgabe sollte etwa Docker version 26.x.x zeigen.


Schritt 5: Zum hermes-Benutzer wechseln

Ab jetzt arbeitest du als hermes, nicht mehr als root:

su - hermes

Die Eingabezeile wechselt von root@ zu hermes@. Alle folgenden Befehle werden als dieser Benutzer ausgeführt.


Schritt 6: Hermes Agent installieren

Führe den offiziellen Installer aus:

curl -sSL https://install.hermes.sh | bash

Der Installer lädt alle Abhängigkeiten herunter und startet anschließend einen interaktiven Setup-Wizard. Das dauert je nach Servergeschwindigkeit 2–5 Minuten.

Nach der Installation die Shell neu laden, damit der hermes-Befehl erkannt wird:

source ~/.bashrc

Installation prüfen:

hermes --version

Was fragt der Setup-Wizard?

Der Wizard führt dich durch vier Hauptfragen:

1. KI-Anbieter wählen

Hermes Anbieter-Auswahl im Setup-Wizard Aus einer umfangreichen Liste von KI-Anbietern – von Nous Portal über OpenAI bis hin zu Google Gemini und DeepSeek.

Für DSGVO-konformen Betrieb empfehlen wir:

  • innoGPT (EU-Hosting, OpenAI-kompatibler Endpunkt) → wähle „OpenAI" und setze die Base-URL auf deinen innoGPT-Endpunkt
  • Ollama (lokale Modelle, keine externen API-Calls) → vollständig offline, maximale Datensouveränität

Für den Einstieg funktioniert auch OpenAI direkt – das lässt sich jederzeit ändern.

2. Terminal-Backend wählen

![Hermes Terminal Backend Auswahl](/images/terminal-für-hermes 2026-06-18 um 14.58.20.png) „Local" lässt Hermes direkt auf dem Server laufen, ohne zusätzliche Container oder Cloud-Sandboxes.

Wähle „Local" – das ist die einfachste Option und läuft direkt auf deinem Server.

3. Browser-Automatisierung

Hermes fragt, ob du einen lokalen Browser für Web-Automatisierung nutzen möchtest. Für einen reinen Chat-/Recherche-Agenten kannst du das überspringen.

4. Web-Backend für Suche (Firecrawl)

Hier trägst du später deine Firecrawl-URL ein (siehe Schritt 7). Du kannst diesen Schritt zunächst überspringen und die URL nachträglich eintragen.

Nach Abschluss erscheint die Erfolgsanzeige:

Hermes Installation Complete Die erfolgreiche Installation – Hermes zeigt alle wichtigen Befehle, Dateipfade und Konfigurationsmöglichkeiten auf einen Blick.


Schritt 7: Firecrawl als kostenloses Webscraping-Tool einrichten

Firecrawl ermöglicht es Hermes, beliebige Webseiten zu durchsuchen und deren Inhalte zu analysieren. In der Self-Hosted-Variante ist das vollständig kostenlos, ohne Limits – und DSGVO-konform.

Firecrawl herunterladen:

cd ~
git clone https://github.com/mendableai/firecrawl.git
cd firecrawl

Konfigurationsdatei aus der Vorlage erstellen:

cp .env.example .env

Firecrawl starten:

docker compose up -d

Docker lädt beim ersten Start alle benötigten Images herunter. Das kann 3–5 Minuten dauern.

Prüfen, ob Firecrawl läuft:

docker compose ps

Alle Container sollten den Status running zeigen.

Testen, ob Firecrawl erreichbar ist:

curl http://localhost:3002/health

Erfolgreiche Antwort: {"status":"ok"}

Nach dem Start ist Firecrawl intern unter http://localhost:3002 erreichbar. Trage diese URL in den Hermes-Wizard ein:

Firecrawl Setup im Hermes-Wizard Im Setup-Wizard von Hermes wird Firecrawl als Web-Backend eingetragen. Die Self-Hosted-URL lautet standardmäßig http://localhost:3002.

Firecrawl nachträglich in Hermes eintragen (falls beim Setup übersprungen):

hermes config set firecrawl.url http://localhost:3002

Praxistipp: Achte in der docker-compose.yaml darauf, dass die CPU-Limits der einzelnen Container nicht die verfügbaren vCPUs überschreiten. Auf einem 2-vCPU-Server sollte keiner der Dienste mehr als 1,5 CPUs reservieren – andernfalls verweigert Docker den Start.


Schritt 8: Hermes starten und testen

Hermes im Chat-Modus starten:

hermes chat

Du siehst jetzt das Hermes-Terminal und kannst direkt mit dem Agenten schreiben. Teste einen einfachen Befehl:

Suche nach den neuesten Nachrichten zu KI-Regulierung in der EU.

Hermes sollte Firecrawl nutzen, eine Websuche durchführen und die Ergebnisse zusammenfassen. Mit Ctrl+C beendest du den Chat-Modus.

Das aktive KI-Modell anzeigen:

hermes model

Zu einem anderen Modell wechseln (Beispiel: Claude):

hermes model set anthropic/claude-opus-4-8

Schritt 9: Hermes mit Discord verbinden

Damit dein Agent über Discord erreichbar ist, brauchst du zunächst einen eigenen Discord Bot.

Discord Bot erstellen

  1. Öffne discord.com/developers/applications und klicke auf „New Application".
  2. Gib dem Bot einen Namen (z. B. „Hermes") und bestätige.
  3. Wechsle links zu „Bot" und klicke auf „Reset Token" → kopiere den Token und bewahre ihn sicher auf.
  4. Aktiviere unter „Privileged Gateway Intents" den Schalter „Message Content Intent" – ohne diesen kann Hermes keine Nachrichten lesen.
  5. Wechsle zu „OAuth2" → „URL Generator", aktiviere bot und die Berechtigungen Send Messages, Read Message History und Read Messages/View Channels.
  6. Öffne die generierte URL in deinem Browser und füge den Bot zu deinem Discord-Server hinzu.

Bot-Token in Hermes eintragen

Öffne die Hermes-Umgebungsdatei:

nano ~/.hermes/.env

Füge folgende Zeilen am Ende der Datei ein:

DISCORD_BOT_TOKEN=DEIN_DISCORD_BOT_TOKEN_HIER
DISCORD_ENABLED=true
GATEWAY_ALLOW_ALL_USERS=true

Speichere mit Ctrl+O, dann Enter, dann Ctrl+X.

Gateway als dauerhaften Dienst installieren

hermes gateway install

Gateway starten:

systemctl --user start hermes-gateway

Prüfen, ob das Gateway läuft:

systemctl --user status hermes-gateway

Der Status sollte active (running) anzeigen.

Gateway beim Serverstart automatisch starten (damit Hermes auch nach einem Neustart sofort verfügbar ist):

loginctl enable-linger hermes

Ab jetzt ist dein Hermes-Agent über Discord erreichbar. Schreibe deinem Bot eine Direktnachricht – er sollte innerhalb weniger Sekunden antworten.

Praxistipp: Nutze für den Alltag bevorzugt Direktnachrichten (DMs) an deinen Discord Bot. Dort musst du Hermes nicht mit @ erwähnen, sondern kannst direkt und flüssig mit ihm chatten – genau wie mit einem echten Kollegen.

DSGVO-Hinweis für Unternehmen: Discord ist ein US-Dienst. Wenn du Personendaten über den Bot verarbeitest, empfehlen wir stattdessen ein selbst gehostetes Matrix/Element-Setup als Messaging-Interface.


Nützliche Befehle im Überblick

Hermes-Status und Logs:

# Gateway-Logs in Echtzeit anzeigen
journalctl --user -u hermes-gateway -f

# Aktuelle Konfiguration anzeigen
hermes config

# Hermes auf die neueste Version aktualisieren
hermes update

Firecrawl verwalten:

# Alle Firecrawl-Container anzeigen
docker compose -f ~/firecrawl/docker-compose.yaml ps

# Firecrawl neu starten (z. B. nach Konfigurationsänderung)
docker compose -f ~/firecrawl/docker-compose.yaml restart

# Firecrawl-Logs anzeigen
docker compose -f ~/firecrawl/docker-compose.yaml logs -f

Gateway-Steuerung:

# Gateway stoppen
systemctl --user stop hermes-gateway

# Gateway neu starten
systemctl --user restart hermes-gateway

# Gateway deinstallieren
hermes gateway uninstall

Stärken & Schwächen im Überblick

Vorteile

  • Vollständige Datenkontrolle: Alle Konversationen und verarbeiteten Daten verbleiben auf deinem eigenen Server.
  • Kein Anbieter-Lock-in: Du wählst frei, welches KI-Modell Hermes nutzen soll – und kannst es jederzeit per hermes model set wechseln.
  • Erweiterbar durch Skills und Tools: Mit 68 integrierten Skills ist Hermes weit mehr als ein Chatbot.
  • Discord-Integration: Der Agent ist bequem über eine vertraute Oberfläche erreichbar – ohne Terminal-Kenntnisse im Alltag.
  • Kostenloser Web-Crawler: Dank Self-Hosted-Firecrawl surft der Agent unbegrenzt und kostenlos durch das Web.
  • DSGVO-Grundlage: Self-Hosting auf europäischer Infrastruktur schafft die technische Basis für DSGVO-Konformität.

Nachteile

  • Technisches Setup erforderlich: Die Ersteinrichtung setzt grundlegende Linux- und Terminal-Kenntnisse voraus.
  • Eigene Infrastruktur nötig: Serverwartung und Updates liegen in deiner eigenen Verantwortung.
  • Discord ist kein DSGVO-konformer Kanal: Für produktive Unternehmensnutzung selbst gehostetes Matrix oder Mattermost bevorzugen.
  • Kein eingebautes Audit-Logging: Für EU AI Act-Konformität ab August 2026 muss dies manuell sichergestellt werden.

Use Cases: Was Hermes wirklich für dich erledigen kann

Der wahre Mehrwert eines selbst gehosteten Agenten liegt nicht im einmaligen Chat – sondern darin, dass er wiederkehrende Aufgaben automatisch und ohne dein Zutun erledigt. Hermes versteht natürlichsprachliche Anweisungen und kann diese als Cron-Job speichern, sodass er sie täglich, stündlich oder wöchentlich ausführt – auch wenn du schläfst.

Das Prinzip dahinter: Du beschreibst dem Agenten einmalig, was er tun soll, wie er dabei vorgehen soll und was mit dem Ergebnis passieren soll. Hermes merkt sich diese Anweisung (den sogenannten „System Prompt" oder Cron-Prompt) und führt sie im Hintergrund aus. Je präziser deine Anweisung, desto besser das Ergebnis – deshalb sind die Prompts in den folgenden Beispielen bewusst ausführlich formuliert.


Use Case 1: Tägliche Social-Media-Recherche

Szenario: Du betreibst eine Agentur oder ein Unternehmen und willst täglich wissen, was in deiner Branche auf Social Media passiert – neue Trendthemen, virale Inhalte, Kampagnen der Konkurrenz, Plattform-Updates. Statt stundenlang Feeds zu scannen, gibt Hermes dir jeden Morgen eine kompakte Zusammenfassung der relevantesten Entwicklungen.

Einrichtung als Cron-Job:

Gib Hermes im Chat folgende Anweisung:

/cron daily 07:00 "Tägliche Social-Media-Recherche"

Deine Aufgabe: Führe täglich um 7:00 Uhr eine Recherche zu aktuellen Social-Media-Trends durch:

1. Welche Inhaltsformate performen gerade besonders gut auf LinkedIn, Instagram und TikTok? (letzten 24h)
2. Gibt es neue Plattform-Features oder Algorithmus-Updates, die für Content-Ersteller relevant sind?
3. Welche Kampagnen oder Marken haben in den letzten 24h besonders viel Aufmerksamkeit erzeugt?
4. Welche Hashtags oder Themen gewinnen gerade an Reichweite?

Gehe dabei so vor:
- Suche mit Firecrawl nach: "Social Media Trends 2026", "LinkedIn Algorithmus aktuell", "TikTok viral heute", "Instagram Reichweite"
- Crawle die Top-3-Ergebnisse je Plattform vollständig
- Fasse die wichtigsten Erkenntnisse in maximal 5 Bulletpoints zusammen
- Markiere explizit, wenn ein Trend Kampagnenpotenzial hat oder sofortiges Handeln erfordert

Sende das Ergebnis als strukturierte Nachricht an diesen Discord-Kanal."

Hermes speichert diesen Job und startet ihn täglich automatisch – ohne weiteres Zutun deinerseits.

Warum der Prompt so ausführlich ist: Hermes ist kein starres Skript, sondern ein Agent, der selbst entscheidet, welche Tools er nutzt und wie er vorgeht. Je genauer du beschreibst, was „gute Recherche" für deinen Fall bedeutet, desto besser trifft der Agent deine Erwartungen. Ein vager Prompt wie „Recherchiere Social Media" führt zu oberflächlichen Ergebnissen; ein präziser Prompt mit Suchbegriffen, Plattformen und Ausgabeformat liefert direkt verwertbare Informationen.


Use Case 2: Website-Crawling & Wettbewerbsbeobachtung

Szenario: Du willst automatisch verfolgen, ob ein Konkurrent seine Preisseite, sein Produktangebot oder seinen Stellenmarkt aktualisiert hat.

Prompt für einen wöchentlichen Crawl:

/cron weekly monday 08:00 "Wettbewerbs-Monitoring Konkurrenz"

Deine Aufgabe: Crawle jeden Montag um 8:00 Uhr folgende Seiten vollständig mit Firecrawl und vergleiche den Inhalt mit der Vorwoche:

- https://www.konkurrenz-a.de/preise
- https://www.konkurrenz-b.de/produkte
- https://www.konkurrenz-c.de/jobs

Gehe dabei so vor:
1. Crawle jede URL und extrahiere: Preise, Produktnamen, Stellenangebote
2. Vergleiche mit dem letzten gespeicherten Stand (aus deiner Memory)
3. Liste alle Änderungen auf – neue Produkte, gestrichene Angebote, Preisänderungen, neue Stellen
4. Bewerte jede Änderung: Ist das strategisch relevant? Warum?

Format: Strukturierter Bericht mit Abschnitt pro Konkurrent, Datum der letzten Änderung, Handlungsempfehlung."

Use Case 3: Tägliches Content-Briefing für Social Media

Prompt:

/cron daily 06:30 "Social-Media-Content-Briefing"

Erstelle täglich um 6:30 Uhr ein Content-Briefing für unsere Social-Media-Redaktion:

1. Suche nach den 3 meistdiskutierten KI-Themen der letzten 24h (Quellen: Fachblogs, LinkedIn-Trends, Hacker News)
2. Prüfe, welches davon zu unserer Positionierung passt (KI für Unternehmen, DSGVO, Produktivität)
3. Formuliere für das passendste Thema:
   - Einen LinkedIn-Post-Entwurf (max. 200 Wörter, sachlich, mit konkretem Nutzen)
   - Einen möglichen Bildtext für Instagram
   - 3 Hashtag-Vorschläge

Ton: professionell, verständlich, kein Buzzword-Bingo."

Use Case 4: Automatische E-Mail-Zusammenfassung (mit Himalaya-Skill)

Hermes enthält den himalaya-Skill, der IMAP-Postfächer lesen kann. Kombiniert mit einem Cron-Job:

/cron daily 08:00 "Morning E-Mail-Digest"

Lese täglich um 8:00 Uhr mein E-Mail-Postfach (IMAP) und erstelle eine priorisierte Zusammenfassung:

1. Liste alle ungelesenen E-Mails der letzten 24h nach Absender und Betreff
2. Kategorisiere sie: Dringend / Wichtig / Info / Kann warten
3. Fasse E-Mails mit mehr als 3 Absätzen in 2 Sätzen zusammen
4. Markiere explizit: Gibt es eine E-Mail, die heute eine Antwort erfordert?

Sende die Zusammenfassung als strukturierte Discord-Nachricht."

⚠️ Wichtig: Kosten und API-Limits im Blick behalten

Ein selbst gehosteter Agent, der rund um die Uhr im Hintergrund läuft und Cron-Jobs ausführt, kann sehr schnell hohe API-Kosten verursachen – besonders wenn er große Mengen Text crawlt, viele Modell-Anfragen stellt oder bei einem Fehler in einer Schleife stecken bleibt.

Warum das passiert

Jede Anfrage an ein KI-Modell (GPT-4o, Claude, Gemini etc.) kostet Tokens – also Geld. Ein einzelner Cron-Job, der eine Website crawlt und einen langen Bericht generiert, kann schnell 10.000–50.000 Tokens verbrauchen. Bei mehreren Jobs täglich, einem teuren Modell und einem unvorhergesehenen Fehler (der den Job neu startet) können die Kosten in wenigen Stunden auf dreistellige Beträge steigen.

Schutzmaßnahmen einrichten

1. Monatliches Ausgabenlimit beim API-Anbieter setzen

Bei OpenAI: Einstellungen → Billing → Usage limits → „Monthly budget" setzen (z. B. 20 €). Bei innoGPT: Im Dashboard unter API-Nutzung ein Monatslimit definieren.

2. Günstigeres Modell für Hintergrundaufgaben wählen

Nicht jeder Cron-Job braucht das teuerste Modell. Für einfache Recherche-Summaries reicht ein schnelles, günstiges Modell vollständig aus:

# Für Cron-Jobs ein günstigeres Modell setzen
hermes config set cron.model gpt-4o-mini
# Oder für maximale Kostenkontrolle: lokales Modell via Ollama
hermes config set cron.model ollama/llama3.1

3. Maximale Token-Anzahl pro Job begrenzen

Füge am Ende jedes Cron-Prompts eine explizite Anweisung ein:

[Systembeschränkung: Verwende maximal 3.000 Output-Tokens pro Ausführung. 
Wenn mehr Inhalt vorhanden ist, priorisiere und kürze.]

4. Logs und Ausgaben überwachen

# Cron-Job-Logs in Echtzeit verfolgen
journalctl --user -u hermes-gateway -f | grep -i cron

# Alle gespeicherten Cron-Jobs anzeigen
hermes cron list

# Einen Cron-Job pausieren
hermes cron pause "Recherche: Sushi & japanisches Essen"

# Einen Cron-Job löschen
hermes cron delete "Recherche: Sushi & japanisches Essen"

5. Testlauf vor Aktivierung

Führe jeden neuen Cron-Prompt einmalig manuell aus, bevor du ihn als wiederkehrenden Job speicherst:

hermes chat
# Dann im Chat:
# "Führe einmalig folgenden Auftrag aus [Dein Prompt]"

So siehst du, wie viele Tokens der Job verbraucht und ob das Ergebnis deinen Erwartungen entspricht – bevor er täglich automatisch läuft.

Faustregel: Starte mit einem günstigen Modell und einfachen Jobs. Erhöhe Modellqualität und Job-Frequenz erst dann, wenn du den tatsächlichen Mehrwert gemessen hast. Ein Agent, der täglich 10 nützliche Erkenntnisse liefert, ist wertvoller als einer, der stündlich teuren Output produziert, den niemand liest.


Häufige Fragen zu Hermes Agent

Fazit: KI-Agenten gehören auf deinen eigenen Server

Der Hermes Agent zeigt eindrucksvoll, dass die Zukunft der KI nicht ausschließlich in der Cloud der großen Anbieter liegt. Wer seine Daten schützen, seine Infrastruktur kontrollieren und seinen KI-Assistenten individuell anpassen möchte, ist mit einem selbst gehosteten Setup bestens aufgestellt.

Für einen vollständig DSGVO-konformen Betrieb empfiehlt sich der folgende Stack:

  • Hermes Agent auf eigenem EU-Server (Hetzner Deutschland) → Konversationen bleiben lokal
  • innoGPT als Modell-Backend → EU-gehostete API, DSGVO-konform, kein US-Datentransfer
  • Firecrawl selbst gehostet → Web-Scraping ohne Datenaustritt
  • Matrix/Element selbst gehostet → Messaging ohne US-Serverberührung

Mit einem modernen Cloudserver ab ca. 19 € pro Monat, Docker und den richtigen Tools lässt sich ein leistungsstarker, 24/7 verfügbarer KI-Agent in wenigen Stunden in Betrieb nehmen – DSGVO-konform, ohne Schatten-IT und ohne, dass deine Unternehmensdaten fremde Server verlassen.

Bereit, deinen eigenen KI-Agenten zu betreiben? Teste innoGPT als Modell-Backend für deinen Hermes-Agenten und erlebe, wie dein Firmenwissen für dich arbeitet.

Kostenloser NewsletterJeden Dienstag

Wöchentliche KI-News ins Postfach

Neue Modelle, Praxistipps & Experteneinschätzungen — kostenlos für alle.

Mit dem Klick auf „Abonnieren" stimmst du dem wöchentlichen KI-Newsletter zu. Abmeldung jederzeit möglich. Datenschutz

Bereit für KI im Unternehmen?

Erleben Sie innoGPT in Aktion und entdecken Sie, wie KI Ihre Arbeit transformiert.

Demo buchen