Das richtige Modell wählen: Leitfaden für hermine.ai
Stand: Juli 2026
In diesem Leitfaden lernen Sie alle in hermine.ai verfügbaren Modelle kennen und finden über Entscheidungstabelle und Praxis-Workflows schnell heraus, welches Modell zu Ihrer Aufgabe passt.
Warum Modell-Agnostik?
Kein einzelnes Modell ist in allen Disziplinen unschlagbar. Manche glänzen mit Geschwindigkeit, andere mit tiefem Reasoning. hermine.ai lässt Sie frei wechseln, sogar im selben Chat. So kombinieren Sie Tempo, Kosten und Genauigkeit je nach Aufgabe: Instant-Modell für die schnelle E-Mail, Thinking-Modell für die Vorstandsanalyse.
Unsere Modelle (aktueller Stand)
| Modell (UI) | Model-ID | Kategorie | Kurzbeschreibung | Typische Use Cases |
|---|---|---|---|---|
| GPT 5.5 Instant | gpt-5.5-instant |
General | Neueste Modellgeneration, sehr gute Qualität bei hohem Tempo | Alltag, Chat, Zusammenfassungen, Standard-Workflows |
| GPT 5.5 Thinking | gpt-5.5-thinking |
Reasoning | Neuestes Reasoning-Modell für die anspruchsvollsten Analysen | Komplexe Planung, tiefe Analysen, schwierige Entscheidungen |
| GPT 5.4 Instant | gpt-5.4-instant |
General | Bewährtes Standardmodell, Voreinstellung im Chat | Alltag, Chat, Zusammenfassungen, Standard-Workflows |
| GPT 5.4 Thinking | gpt-5.4-thinking |
Reasoning | Denkt vor dem Antworten nach, robust bei komplexen Aufgaben | Planung, Analysen, schwierige Entscheidungen, Debugging |
| GPT 5.2 Instant | gpt-5.2-instant |
General | Standardmodell mit ausgewogenem Verhältnis von Leistung und Kosten | Alltag, Chat, Zusammenfassungen |
| GPT 5.2 Thinking | gpt-5.2-thinking |
Reasoning | Höhere Qualität bei komplexen Aufgaben | Planung, Analysen, strukturierte Outputs |
| GPT 5.1 Instant | gpt-5.1-instant |
Fast | Sehr schnelle Antworten ohne Denkpause | Einfache Fragen, Routineaufgaben, Support-Macros |
| GPT 5.1 Thinking | gpt-5.1-thinking |
Reasoning | Mehrstufiges Denken zum günstigeren Preis | Strategische Planung, tiefe Analysen |
| GPT 5-mini | gpt-5-mini |
Efficient | Kompaktes, kostengünstiges Modell für klar definierte Aufgaben | Einfache Automatisierung, Chat, Klassifizierungen |
| GPT 5.4-mini | gpt-5.4-mini |
Efficient | Schnelles, effizientes Modell für Standardaufgaben | Übersetzungen, Reporting, Kundensupport |
| GPT 5.4-nano | gpt-5.4-nano |
Lightweight | Ultraschnelles, kosteneffizientes Modell für einfache Aufgaben | Schnelle Abfragen, Klassifizierungen, kurze Zusammenfassungen |
| Claude Opus 4.8 | claude-opus-4-8 |
Premium | Hochwertigstes Claude-Modell für nuanciertes Reasoning und Langtexte | Anspruchsvolle Analysen, Premium-Texte, Strategie, Konzepte |
| Claude Opus 4.7 | claude-opus-4-7 |
Premium | Vorgängerversion von Opus 4.8, weiterhin sehr stark | Anspruchsvolle Analysen, Premium-Texte |
| Claude Opus 4.6 | claude-opus-4-6 |
Premium | Ältere Opus-Version für bestehende Workflows | Anspruchsvolle Analysen, Premium-Texte |
| Claude Sonnet 4.6 | claude-sonnet |
General | Ausgewogenes Claude-Modell für starke Qualität in Analyse und Alltag | Schreiben, Analysen, Reviews, längere strukturierte Outputs |
| Claude Haiku 4.5 | claude-haiku |
Efficient | Schnelles Claude-Modell für leichte Aufgaben | Zusammenfassungen, Routineaufgaben, kostenbewusste Workflows |
| o4-mini | o4-mini |
Reasoning | Reasoning-Modell, stark in Code und Logik, mit Bildinput | Code-Generierung, logische Aufgaben, visueller Kontext |
| o3 | o3 |
Reasoning (advanced) | Fortgeschrittenes Reasoning für komplexe Logik und konzeptuelle Analysen | Anspruchsvolle Analysen, komplexe Problemlösung, Konzepte |
| Qwen 3.5 | qwen3.5-397b-a17b |
Open Source | Open-Source MoE-Modell mit 397B Parametern (17B aktiv, 512 Experten), multimodales Reasoning | Code, mehrsprachige Aufgaben (201 Sprachen), Open-Source-Anforderungen |
Hinweis: Die Claude-Modelle laufen über AWS Bedrock und können je nach Account deaktiviert sein. In diesem Fall erscheinen sie nicht in der Modellauswahl. Standardmodell im Chat ist GPT 5.4 Instant.
Schnellcheck: Welches Modell passt?
| Priorität | Empfehlung |
|---|---|
| Bestes Default für „fast alles" | GPT 5.4 Instant |
| Anspruchsvollste Aufgaben, beste Qualität | GPT 5.5 Thinking oder Claude Opus 4.8 |
| Komplexe Planung und tiefe Analysen | GPT 5.4 Thinking oder o3 |
| Sehr schnelle Routine-Antworten | GPT 5.1 Instant |
| Hochwertige Texte und längere strukturierte Ausgaben | Claude Sonnet 4.6 oder Claude Opus 4.8 |
| Übersetzungen, Reporting günstig und schnell | GPT 5.4-mini |
| Einfache Aufgaben, Klassifizierungen, schnelle Abfragen | GPT 5.4-nano oder GPT 5-mini |
| Code und Logik mit Reasoning und Bildinput | o4-mini |
| Open-Source-Anforderung | Qwen 3.5 |
Modell im Chat wechseln (Schritt für Schritt)
- Öffnen Sie einen Chat. Über dem Eingabefeld sehen Sie die Modell-Schaltfläche mit dem aktuellen Modellnamen (z. B. GPT 5.4 Instant).
- Klicken Sie darauf. Es öffnet sich die Modellliste mit dem Suchfeld Modelle suchen.
- Klicken Sie bei Bedarf auf Mehr Modelle, um alle verfügbaren Modelle einzublenden (Weniger Modelle klappt die Liste wieder zu).
- Wählen Sie ein Modell per Klick. Der bisherige Chat-Verlauf bleibt erhalten und wird an das neue Modell übergeben. Ihre Auswahl merkt sich hermine.ai für kommende Chats.
- Reasoning-fähige Modelle erkennen Sie am Badge Denkmodus. Bei diesen können Sie über die Stoppuhr-Schaltfläche die Denkdauer (Schnell, Standard, Umfassend) einstellen. Mehr dazu unter Reasoning-Modelle verstehen und einsetzen.

- Die Modell-Schaltfläche über dem Eingabefeld zeigt das aktuell gewählte Modell.
- Über das Suchfeld Modelle suchen filtern Sie die Liste.
- Das Badge Denkmodus kennzeichnet Reasoning-fähige Modelle.
- Mehr Modelle blendet alle weiteren verfügbaren Modelle ein.
Praxis-Workflows
Alltag und Chat
Standard-Antworten, E-Mails, kurze Reports
Modell: GPT 5.4 Instant
Warum: guter Allrounder, gutes Preis/Leistungs-Verhältnis.
Anspruchsvollste Aufgaben
Strategiepapiere, heikle Entscheidungen, höchste Qualitätsansprüche
Modell: GPT 5.5 Thinking oder Claude Opus 4.8
Warum: die stärksten Modelle der jeweiligen Familie, maximale Qualität.
Mehrstufige Planung oder schwierige Entscheidungen
Strategische Planung, Entscheidungsbäume, tiefe Analysen
Modell: GPT 5.4 Thinking oder o3
Warum: stabil bei komplexen Aufgaben, weniger schnelle Fehlschlüsse.
Support, Standard-Reports, Übersetzungen
Kundensupport, Reporting, Zusammenfassungen
Modell: GPT 5.4-mini oder GPT 5.1 Instant
Warum: schnell, effizient.
Hochwertige Texte
Blogartikel, Konzepte, längere strukturierte Dokumente
Modell: Claude Sonnet 4.6 oder Claude Opus 4.8
Warum: nuancierter Schreibstil, stark bei Langtexten.
Code, Logik und visuelles Reasoning
Code-Generierung, logische Aufgaben, technische Zeichnungen
Modell: o4-mini
Warum: stark in Reasoning plus Bildinput.
Open-Source-Anforderung
Compliance-Vorgaben, mehrsprachige Aufgaben
Modell: Qwen 3.5
Warum: Open-Source-Modell mit multimodalem Reasoning und 201 Sprachen.
Kosten vs. Qualität optimieren
- Hybrid nutzen: Reasoning-Modell für den Plan, dann Instant-Modell für die Ausführung (ein Beispiel-Workflow steht im Artikel Reasoning-Modelle).
- Kontext kürzen: Entfernen Sie irrelevante Absätze, um Tokens zu sparen. Umfangreiche Dokumente gehören in eine Wissensdatenbank.
- Outputs standardisieren: Klare Formatvorgaben reduzieren Nachfragen und Kosten, am einfachsten per Prompt-Vorlage.
Fazit
hermine.ai deckt ein breites Spektrum ab: vom Turbo-Chatbot bis zum tiefgründigen Analysten, inklusive Open-Source-Option. Testen Sie in Ihrem Anwendungsfall, messen Sie Geschwindigkeit, Kosten und Qualität, und stellen Sie Ihren idealen Modell-Mix zusammen.
Tipp: Beginnen Sie z. B. mit GPT 5.4 Instant zur Ideensammlung. Wechseln Sie auf GPT 5.4 Thinking oder o3, wenn tiefere Analysen nötig werden.
War diese Seite hilfreich?