Für Hermes Agent im September 2026 ist Claude Sonnet 5 ein praxistauglicher Ausgangspunkt für tägliche Automatisierung, Claude Opus 5 oder GPT-5.6 Sol eignet sich für anspruchsvollere Aufgaben, und DeepSeek V4.1 Flash oder GLM-5.3 Flash hält routinemäßige Durchläufe kostengünstig. Das sind Ausgangspunkte, kein kontrollierter Hermes-Benchmark. Ein Modell, das in einem Coding-Leaderboard gut abschneidet, kann dennoch an einer langen Tool-Schleife scheitern oder durch Wiederholungsversuche teurer werden.

Hermes ermöglicht es, das Hauptmodell zu wechseln, ohne den Agenten selbst zu ändern. Der Modell-Konfigurationsleitfaden trennt außerdem das Hauptmodell von Hilfsmodellen, die für kleinere Aufgaben eingesetzt werden. So können Sie in die Reasoning-Schleife investieren und für Komprimierung oder Zusammenfassung günstigere Modelle wählen. Die unten aufgeführten Modell-IDs wurden am 16. September 2026 mit dem Live-Katalog von haimaker abgeglichen; Verfügbarkeit und Preise können sich ändern.

Mit welchem Modell sollten Sie starten?

Beginnen Sie mit der Aufgabe, die Ihr Agent am häufigsten ausführt. In aktuellen Hermes-Nutzerberichten verwenden verschiedene Personen unterschiedliche Modelle für tägliche Arbeit, anspruchsvolles Reasoning und lokale private Aufgaben. Die Tabelle bietet eine kurze Auswahlliste zum Testen mit Ihren eigenen Prompts, Tools und Fehlerfällen.

Hermes-ArbeitslastZuerst zu testendes Modellhaimaker-Modell-IDAbwägung
Täglicher Assistent und AutomatisierungClaude Sonnet 5anthropic/claude-sonnet-5Zuverlässiger Premium-Standard; teurer als günstige Modelle
Produktions-Coding und schwieriges DebuggingClaude Opus 5anthropic/claude-opus-5Höhere Reasoning-Obergrenze; höhere Kosten pro Durchlauf
Anspruchsvolle Planung mit einem OpenAI-ModellGPT-5.6 Solopenai/gpt-5.6-solWeitere Premium-Option; Token-Verbrauch bei langen Läufen vergleichen
Langkontext-RechercheGemini 3.8 Flashgoogle/gemini-3.8-flashGroßes Kontextfenster; Antwortqualität mit eigenen Dokumenten prüfen
Open-Weight-Modell über eine Cloud-APIKimi K3moonshotai/kimi-k3Flexible Alternative; Anbieter-Latenz und Tool-Nutzung testen
Budget-HintergrundaufgabenDeepSeek V4.1 Flash oder GLM-5.3 Flashdeepseek/deepseek-v4.1-flash oder z-ai/glm-5.3-flashNiedrigere Token-Kosten; Wiederholungsversuche können die Ersparnis zunichtemachen

Diese Auswahl spiegelt die aktuelle Verfügbarkeit und gemeldete Nutzung wider – nicht die Behauptung, dass jedes Modell dieselbe Hermes-Testsuite bestanden hat. Der August-Provider-Überblick der Hermes-Community ordnet Sonnet und Opus ebenfalls in die Qualitätsstufe ein, während Budget-Nutzer DeepSeek und GLM bevorzugen. Die Preise in diesem Überblick sind eine Momentaufnahme – prüfen Sie daher den Live-Katalog, bevor Sie ein Budget festlegen.

Wie wechselt man das Modell in Hermes Agent?

Führen Sie hermes model aus, wählen Sie Custom endpoint und geben Sie die Basis-URL, den API-Schlüssel und die Modell-ID ein. Hermes speichert die Endpunkt-Auswahl in seiner Konfiguration. Sie können dann Modelle bei derselben Aufgabe vergleichen, statt ihr Verhalten aus unpassenden Benchmarks abzuleiten.

export HAIMAKER_API_KEY=your-haimaker-key
npx -y @haimaker/connect --hermes

@haimaker/connect schreibt die Hermes-Endpunktkonfiguration und verifiziert den Schlüssel. Für die manuelle Einrichtung verwenden Sie https://api.haimaker.ai/v1 als Basis-URL und kopieren Sie eine aktuelle ID aus dem Modell-Katalog. Der Hermes-Custom-Provider-Leitfaden behandelt anbieterspezifische URLs und Timeout-Korrekturen.

Das Wechseln des Modells ist nur eine Variable. Wenn ein Recherche-Durchlauf fehlschlägt, prüfen Sie Suche, Extraktion, Browserzugriff und Tool-Berechtigungen, bevor Sie dem Modell die Schuld geben. Hermes-Nutzer haben berichtet, dass diese Abhängigkeiten das Ergebnis dominieren können.

Welches Modell passt zu welcher Aufgabe?

Tägliche Automatisierung: Claude Sonnet 5 ist das erste Cloud-Modell, das Sie ausprobieren sollten, wenn Hermes Nachrichten, Dateien und geplante Aufgaben verarbeitet. Führen Sie eine repräsentative Mehrschritt-Aufgabe aus und zählen Sie fehlgeschlagene Tool-Aufrufe, Retries und die Gesamtanzahl der Token. Wenn die Aufgabe routinemäßig ist, vergleichen Sie sie mit einem günstigen Modell, bevor Sie sich auf einen Premium-Standard festlegen.

Kritisches Coding: Claude Opus 5 und GPT-5.6 Sol sind Kandidaten, wenn der Agent ein Produktions-Repository bearbeitet oder sich von schwierigen Fehlern erholen muss. Vergleichen Sie sie bei demselben Issue mit denselben Tools. Ein einzelner erfolgreicher Durchlauf ist ein nützlicher Hinweis, aber wiederholte Durchläufe zeigen, ob das Modell Unterbrechungen und Fehler konsistent bewältigt.

Lange Dokumente und Recherche: Gemini 3.8 Flash verfügt im aktuellen haimaker-Katalog über ein großes Kontextfenster. Deshalb lohnt sich ein Test, wenn Hermes viele Dokumente oder Tool-Ergebnisse verarbeiten muss. Ein großes Kontextfenster garantiert keine korrekte Wiedergabe; überprüfen Sie die Antwort anhand der Quelldateien.

Dauerhafte Hintergrundaufgaben: DeepSeek V4.1 Flash und GLM-5.3 Flash sind kostengünstige Optionen. MiniMax M3 (minimax/minimax-m3) bleibt verfügbar, wenn Sie es bereits nutzen. Geben Sie jedem Kandidaten eine begrenzte Aufgabe, ein Retry-Limit und eine Ausgabenobergrenze. Ein günstiges Modell, das fehlgeschlagene Aktionen wiederholt, kann teurer werden als ein stärkeres Modell, das die Aufgabe in einem Durchlauf erledigt. Halten Sie ein Premium-Modell für Eskalationen bereit, statt jede Aufgabe dorthin zu senden.

Verwenden Sie einen haimaker.ai-Schlüssel, um diese Modelle bei derselben Hermes-Aufgabe zu vergleichen. Behalten Sie das Modell, das die Arbeit zuverlässig zu akzeptablen Gesamtkosten erledigt.

MODELLE MIT EINEM SCHLÜSSEL TESTEN

Sollte man Hermes mit einem lokalen Modell betreiben?

Hermes kann einen lokalen OpenAI-kompatiblen Endpunkt verwenden. Der Leitfaden für lokale Modelle empfiehlt, einen Build zu wählen, der in Ihr tatsächliches Speicherbudget passt – einschließlich Kontextzustand und Laufzeitpuffer. Ein Modell, das gerade noch geladen werden kann, hat möglicherweise zu wenig Platz für den Kontext, den ein langer Agent-Durchlauf benötigt.

Lokale Nutzung ist sinnvoll, wenn private Daten auf Ihrem Rechner bleiben müssen oder Sie bereits die Hardware besitzen. Die September-Hermes-Modelldiskussion enthält Nutzer, die ein lokales Hauptmodell mit Cloud-Modellen für schwierigere Aufgaben kombinieren. Testen Sie Tool-Aufrufe und Kontextverarbeitung, bevor Sie ein lokales Modell unbeaufsichtigt laufen lassen. Unser Leitfaden zu Ollama-Coding-Modellen behandelt Hardware-Stufen, und günstigste APIs für Coding-Agenten deckt die Cloud-Seite ab.

Wie sollte man die Finalisten vergleichen?

Führen Sie dieselben drei Aufgaben mit jedem Kandidaten aus: eine routinemäßige Automatisierung, eine lange Tool-Sequenz und einen Fehler, der eine Wiederherstellung erfordert. Erfassen Sie Abschluss, fehlerhafte Tool-Aufrufe, Wiederholungsversuche, Laufzeit und Gesamtkosten. Halten Sie die Aufgabenanweisungen und den Tool-Zugriff konstant, damit das Modell die Hauptvariable bleibt. Wenn ein Modell nur in einem Benchmark gewinnt, aber in Ihrem Workflow scheitert, wählen Sie dasjenige, das Ihre Arbeit erledigt.

Hermes entwickelt sich schnell weiter, und die Modell-Kataloge ändern sich entsprechend. Prüfen Sie die Modell-IDs im Live-Katalog erneut, wenn Sie den Agenten konfigurieren, und wiederholen Sie diesen kleinen Vergleich, wenn ein neues Modell vielversprechend aussieht.

Häufig gestellte Fragen

Was ist das beste Modell für Hermes Agent im Jahr 2026?

Claude Sonnet 5 ist ein solider Ausgangspunkt für die tägliche Hermes-Automatisierung. Wechseln Sie zu Claude Opus 5 oder GPT-5.6 Sol, wenn eine schwierige Aufgabe den Aufpreis rechtfertigt, und testen Sie ein Budget-Modell wie DeepSeek V4.1 Flash oder GLM-5.3 Flash für routinemäßige Hintergrundaufgaben. Ihre eigenen toolintensiven Aufgaben sind der entscheidende Test.

Was ist das günstigste Modell, das in Hermes Agent gut funktioniert?

DeepSeek V4.1 Flash und GLM-5.3 Flash sind aktuelle kostengünstige Cloud-Optionen im haimaker-Katalog. Ein lokales Modell vermeidet Token-basierte API-Kosten, benötigt jedoch geeignete Hardware und kann bei langen Tool-Schleifen Probleme haben. Testen Sie Zuverlässigkeit und Gesamtkosten pro Aufgabe, bevor Sie ein Standardmodell festlegen.

Wie ändere ich das Modell, das Hermes Agent verwendet?

Führen Sie hermes model aus, wählen Sie Custom endpoint und geben Sie die Basis-URL, den API-Schlüssel und die Modell-ID ein. Mit haimaker.ai verwenden Sie https://api.haimaker.ai/v1 und eine Modell-ID aus dem Live-Katalog. Sie können auch npx -y @haimaker/connect --hermes ausführen, um den Endpunkt zu konfigurieren.

HERMES MIT HAIMAKER BETREIBEN


Vergleichen Sie Agenten statt Modelle? Siehe Hermes vs. Codex. Richten Sie den Endpunkt selbst ein? Siehe den Hermes-Custom-Provider-Leitfaden.