VerwaltungsGPT – Use-Case Sprint: Die 2 besten Entlastungsfälle finden, 15. OktoberAnmelden

Modellunabhängig

GPT, Claude und Open Source in einer Oberfläche: wechselbar mitten im Gespräch, ohne den Verlauf zu verlieren.

Modelle
GPT 6 Sol Instant
GPT 6 Sol Thinking
Claude Opus 5
Claude Sonnet 5
Qwen 3.8 27B
VerwaltungsGPTGPT 6 Sol Instant
Neue Nachricht an hermine.ai …
Deep Research

Die Modelle.

23 Modelle, Stand September 2026. Standardmodell im Chat ist GPT 6 Sol Instant.

OpenAI18
über Microsoft Azure AI Foundry
GPT 6 SolAktuelle Generation, Voreinstellung im Chat, bis zu 1 Mio. Token Kontext
General
GPT 6 LunaSehr schnell und sehr günstig für Routineaufgaben und hohe Volumen
Efficient
GPT 5.6 SolSpitzenmodell der Vorgängergeneration, jetzt 20 % günstiger
Premium
GPT 5.6 TerraAusgewogenes Modell der Vorgängergeneration, jetzt 12 % günstiger
General
+ 14 weitere aus den Generationen 5.1 bis 5.6
Anthropic2
über Microsoft Azure AI Foundry
Claude Opus 5Leistungsstärkstes Claude-Modell für nuanciertes Reasoning und hochwertige Texte
Premium
Claude Sonnet 5Ausgewogenes Claude-Modell für Alltag, Analyse und längere Textarbeiten
General
Open Source3
Qwen 3.5MoE-Modell mit 397B Parametern (17B aktiv), multimodales Reasoning, 201 Sprachen
Open Source
Qwen 3.6 35bKompaktes MoE-Modell mit 35B Parametern (3B aktiv), selbst gehostet in der EU
Open Source
Qwen 3.8 27BAktuelle Qwen-Generation, sehr günstig, 256.000 Token Kontext, betrieben in der EU
Open Source
Gut zu wissen
Admin entscheidet mitModelle lassen sich pro Account freischalten oder ausblenden
Denkdauer regelbarBei Reasoning-Modellen: Schnell, Standard oder Umfassend
Neue ModelleErscheinen in derselben Liste, ohne Umbau Ihrer Assistenten

Welches Modell
passt zu welcher Aufgabe?

Als Faustregel: im Zweifel mit dem Standardmodell anfangen und hochschalten, wenn die Antwort nicht trägt.

Bestes Default für fast alles
GPT 6 Sol Instant
Anspruchsvollste Aufgaben, beste Qualität
GPT 6 Sol ThinkingoderClaude Opus 5
Komplexe Planung und tiefe Analysen
GPT 6 Sol ThinkingoderGPT 5.6 Sol Thinking
Ganze Dokumentenstapel in einer Frage
GPT 6 Sol ThinkingoderGPT 6 Sol Instant
Hochwertige Texte, längere Dokumente
Claude Sonnet 5oderClaude Opus 5
Übersetzungen und Reporting, günstig und schnell
GPT 6 Luna InstantoderGPT 5.6 Luna Instant
Klassifizierungen und kurze Abfragen
GPT 6 Luna InstantoderGPT 5.4-nano
Code und Logik
GPT 6 Sol ThinkingoderGPT 6 Luna Thinking
Open-Source-Anforderung, viele Sprachen
Qwen 3.8 27BoderQwen 3.5

Modellvielfalt
ohne Datenreise.

Die Auswahl ist groß, der rechtliche Rahmen bleibt derselbe: DSGVO-konform, Hosting in Deutschland und der EU, Mandantentrennung bis auf Dokumentebene.

Ein Vertrag statt fünfSie schließen einen einzigen Vertrag mit hermine.ai, der alle Modellanbieter abdeckt.
Admins steuern die AuswahlWelche Modelle im Chat erscheinen, entscheiden Sie pro Account.
Open Source als RückfallebeneFür Anforderungen ohne US-Anbieter stehen Qwen 3.5, 3.6 und 3.8 bereit, selbst gehostet in der EU.
Plattform
DSGVO-konform
Datenhoheit in der EU
Ein Vertrag für alle Modelle
Modelle pro Account freischaltbar
Mandantentrennung
Open-Source-Modell verfügbar
Hosting / Deutschland & EU
Die Plattform läuft auf Servern von Hetzner in Deutschland und Finnland. GPT- und Claude-Modelle werden über Microsoft Azure AI Foundry mit europäischem Endpunkt bereitgestellt, per Auftragsverarbeitung und ohne Training mit Ihren Daten. Die Open-Source-Modelle laufen selbst gehostet bei Scaleway in Frankreich. Wer US-Anbieter ausschließen muss, deaktiviert GPT und Claude pro Account und arbeitet mit den Open-Source-Modellen. Auf Wunsch läuft die Plattform dediziert in Ihrer Cloud oder On-Premises.
Betriebsmodelle
Cloud in Deutschland / EU
Dedizierte Instanz in Ihrer Cloud
On-Premises in Ihrem Haus
Entwickelt in Deutschland · zauberware

Fragen zur
Modellauswahl.

Was in Demos und Schulungen am häufigsten gefragt wird.

Ja. Der bisherige Chat-Verlauf wird an das neue Modell übergeben. Sie können also mit einem schnellen Modell sammeln und für die Ausarbeitung hochschalten. Die Auswahl merkt sich hermine.ai für kommende Chats.

Reasoning-fähige Modelle tragen in der Liste das Badge „Denkmodus". Sie arbeiten vor der Antwort mehrere Schritte durch. Bei ihnen lässt sich zusätzlich die Denkdauer einstellen: Schnell, Standard oder Umfassend.

Welche Modelle in der Auswahl erscheinen, steuern Ihre Admins pro Account. GPT- und Claude-Modelle laufen über Microsoft Azure AI Foundry und lassen sich separat deaktivieren, dann arbeitet Ihr Account ausschließlich mit den Open-Source-Modellen.

Sie kommt in dieselbe Liste. Ihre Assistenten, Wissensdatenbanken, Prompt-Vorlagen und Werkzeuge bleiben unverändert, es ändert sich nur, welches Modell dahinter rechnet.

Drei Hebel: das Reasoning-Modell nur für den Plan nutzen und die Ausführung an ein Instant-Modell geben; den Kontext schlank halten und umfangreiche Dokumente in eine Wissensdatenbank legen; Ausgaben über Prompt-Vorlagen standardisieren, damit Nachfragen entfallen.

Sprechen wir über Ihren Anwendungsfall.

Sagen Sie uns, was Sie vorhaben. Wir zeigen Ihnen hermine.ai live.

30 Min · online · kostenlosDemo vereinbaren
Öffnen Sie unseren Kalender und suchen Sie sich einen Termin aus.