Modellauswahl

Das richtige Modell wählen: Leitfaden für hermine.ai

Stand: Juli 2026

In diesem Leitfaden lernen Sie alle in hermine.ai verfügbaren Modelle kennen und finden über Entscheidungstabelle und Praxis-Workflows schnell heraus, welches Modell zu Ihrer Aufgabe passt.

Warum Modell-Agnostik?

Kein einzelnes Modell ist in allen Disziplinen unschlagbar. Manche glänzen mit Geschwindigkeit, andere mit tiefem Reasoning. hermine.ai lässt Sie frei wechseln, sogar im selben Chat. So kombinieren Sie Tempo, Kosten und Genauigkeit je nach Aufgabe: Instant-Modell für die schnelle E-Mail, Thinking-Modell für die Vorstandsanalyse.

Unsere Modelle (aktueller Stand)

Modell (UI) Model-ID Kategorie Kurzbeschreibung Typische Use Cases
GPT 5.5 Instant gpt-5.5-instant General Neueste Modellgeneration, sehr gute Qualität bei hohem Tempo Alltag, Chat, Zusammenfassungen, Standard-Workflows
GPT 5.5 Thinking gpt-5.5-thinking Reasoning Neuestes Reasoning-Modell für die anspruchsvollsten Analysen Komplexe Planung, tiefe Analysen, schwierige Entscheidungen
GPT 5.4 Instant gpt-5.4-instant General Bewährtes Standardmodell, Voreinstellung im Chat Alltag, Chat, Zusammenfassungen, Standard-Workflows
GPT 5.4 Thinking gpt-5.4-thinking Reasoning Denkt vor dem Antworten nach, robust bei komplexen Aufgaben Planung, Analysen, schwierige Entscheidungen, Debugging
GPT 5.2 Instant gpt-5.2-instant General Standardmodell mit ausgewogenem Verhältnis von Leistung und Kosten Alltag, Chat, Zusammenfassungen
GPT 5.2 Thinking gpt-5.2-thinking Reasoning Höhere Qualität bei komplexen Aufgaben Planung, Analysen, strukturierte Outputs
GPT 5.1 Instant gpt-5.1-instant Fast Sehr schnelle Antworten ohne Denkpause Einfache Fragen, Routineaufgaben, Support-Macros
GPT 5.1 Thinking gpt-5.1-thinking Reasoning Mehrstufiges Denken zum günstigeren Preis Strategische Planung, tiefe Analysen
GPT 5-mini gpt-5-mini Efficient Kompaktes, kostengünstiges Modell für klar definierte Aufgaben Einfache Automatisierung, Chat, Klassifizierungen
GPT 5.4-mini gpt-5.4-mini Efficient Schnelles, effizientes Modell für Standardaufgaben Übersetzungen, Reporting, Kundensupport
GPT 5.4-nano gpt-5.4-nano Lightweight Ultraschnelles, kosteneffizientes Modell für einfache Aufgaben Schnelle Abfragen, Klassifizierungen, kurze Zusammenfassungen
Claude Opus 4.8 claude-opus-4-8 Premium Hochwertigstes Claude-Modell für nuanciertes Reasoning und Langtexte Anspruchsvolle Analysen, Premium-Texte, Strategie, Konzepte
Claude Opus 4.7 claude-opus-4-7 Premium Vorgängerversion von Opus 4.8, weiterhin sehr stark Anspruchsvolle Analysen, Premium-Texte
Claude Opus 4.6 claude-opus-4-6 Premium Ältere Opus-Version für bestehende Workflows Anspruchsvolle Analysen, Premium-Texte
Claude Sonnet 4.6 claude-sonnet General Ausgewogenes Claude-Modell für starke Qualität in Analyse und Alltag Schreiben, Analysen, Reviews, längere strukturierte Outputs
Claude Haiku 4.5 claude-haiku Efficient Schnelles Claude-Modell für leichte Aufgaben Zusammenfassungen, Routineaufgaben, kostenbewusste Workflows
o4-mini o4-mini Reasoning Reasoning-Modell, stark in Code und Logik, mit Bildinput Code-Generierung, logische Aufgaben, visueller Kontext
o3 o3 Reasoning (advanced) Fortgeschrittenes Reasoning für komplexe Logik und konzeptuelle Analysen Anspruchsvolle Analysen, komplexe Problemlösung, Konzepte
Qwen 3.5 qwen3.5-397b-a17b Open Source Open-Source MoE-Modell mit 397B Parametern (17B aktiv, 512 Experten), multimodales Reasoning Code, mehrsprachige Aufgaben (201 Sprachen), Open-Source-Anforderungen

Hinweis: Die Claude-Modelle laufen über AWS Bedrock und können je nach Account deaktiviert sein. In diesem Fall erscheinen sie nicht in der Modellauswahl. Standardmodell im Chat ist GPT 5.4 Instant.

Schnellcheck: Welches Modell passt?

Priorität Empfehlung
Bestes Default für „fast alles" GPT 5.4 Instant
Anspruchsvollste Aufgaben, beste Qualität GPT 5.5 Thinking oder Claude Opus 4.8
Komplexe Planung und tiefe Analysen GPT 5.4 Thinking oder o3
Sehr schnelle Routine-Antworten GPT 5.1 Instant
Hochwertige Texte und längere strukturierte Ausgaben Claude Sonnet 4.6 oder Claude Opus 4.8
Übersetzungen, Reporting günstig und schnell GPT 5.4-mini
Einfache Aufgaben, Klassifizierungen, schnelle Abfragen GPT 5.4-nano oder GPT 5-mini
Code und Logik mit Reasoning und Bildinput o4-mini
Open-Source-Anforderung Qwen 3.5

Modell im Chat wechseln (Schritt für Schritt)

  1. Öffnen Sie einen Chat. Über dem Eingabefeld sehen Sie die Modell-Schaltfläche mit dem aktuellen Modellnamen (z. B. GPT 5.4 Instant).
  2. Klicken Sie darauf. Es öffnet sich die Modellliste mit dem Suchfeld Modelle suchen.
  3. Klicken Sie bei Bedarf auf Mehr Modelle, um alle verfügbaren Modelle einzublenden (Weniger Modelle klappt die Liste wieder zu).
  4. Wählen Sie ein Modell per Klick. Der bisherige Chat-Verlauf bleibt erhalten und wird an das neue Modell übergeben. Ihre Auswahl merkt sich hermine.ai für kommende Chats.
  5. Reasoning-fähige Modelle erkennen Sie am Badge Denkmodus. Bei diesen können Sie über die Stoppuhr-Schaltfläche die Denkdauer (Schnell, Standard, Umfassend) einstellen. Mehr dazu unter Reasoning-Modelle verstehen und einsetzen.

Modellauswahl im Chat: Klick auf die Modell-Schaltfläche öffnet die Liste mit Suche, Denkmodus-Badge und 'Mehr Modelle'.

  1. Die Modell-Schaltfläche über dem Eingabefeld zeigt das aktuell gewählte Modell.
  2. Über das Suchfeld Modelle suchen filtern Sie die Liste.
  3. Das Badge Denkmodus kennzeichnet Reasoning-fähige Modelle.
  4. Mehr Modelle blendet alle weiteren verfügbaren Modelle ein.

Praxis-Workflows

Alltag und Chat

Standard-Antworten, E-Mails, kurze Reports

Modell: GPT 5.4 Instant
Warum: guter Allrounder, gutes Preis/Leistungs-Verhältnis.

Anspruchsvollste Aufgaben

Strategiepapiere, heikle Entscheidungen, höchste Qualitätsansprüche

Modell: GPT 5.5 Thinking oder Claude Opus 4.8
Warum: die stärksten Modelle der jeweiligen Familie, maximale Qualität.

Mehrstufige Planung oder schwierige Entscheidungen

Strategische Planung, Entscheidungsbäume, tiefe Analysen

Modell: GPT 5.4 Thinking oder o3
Warum: stabil bei komplexen Aufgaben, weniger schnelle Fehlschlüsse.

Support, Standard-Reports, Übersetzungen

Kundensupport, Reporting, Zusammenfassungen

Modell: GPT 5.4-mini oder GPT 5.1 Instant
Warum: schnell, effizient.

Hochwertige Texte

Blogartikel, Konzepte, längere strukturierte Dokumente

Modell: Claude Sonnet 4.6 oder Claude Opus 4.8
Warum: nuancierter Schreibstil, stark bei Langtexten.

Code, Logik und visuelles Reasoning

Code-Generierung, logische Aufgaben, technische Zeichnungen

Modell: o4-mini
Warum: stark in Reasoning plus Bildinput.

Open-Source-Anforderung

Compliance-Vorgaben, mehrsprachige Aufgaben

Modell: Qwen 3.5
Warum: Open-Source-Modell mit multimodalem Reasoning und 201 Sprachen.

Kosten vs. Qualität optimieren

  • Hybrid nutzen: Reasoning-Modell für den Plan, dann Instant-Modell für die Ausführung (ein Beispiel-Workflow steht im Artikel Reasoning-Modelle).
  • Kontext kürzen: Entfernen Sie irrelevante Absätze, um Tokens zu sparen. Umfangreiche Dokumente gehören in eine Wissensdatenbank.
  • Outputs standardisieren: Klare Formatvorgaben reduzieren Nachfragen und Kosten, am einfachsten per Prompt-Vorlage.

Fazit

hermine.ai deckt ein breites Spektrum ab: vom Turbo-Chatbot bis zum tiefgründigen Analysten, inklusive Open-Source-Option. Testen Sie in Ihrem Anwendungsfall, messen Sie Geschwindigkeit, Kosten und Qualität, und stellen Sie Ihren idealen Modell-Mix zusammen.

Tipp: Beginnen Sie z. B. mit GPT 5.4 Instant zur Ideensammlung. Wechseln Sie auf GPT 5.4 Thinking oder o3, wenn tiefere Analysen nötig werden.

War diese Seite hilfreich?