Modellrollen und LLM-Zugriff
Whisperer verwendet mehrere spezialisierte Modelle über ein einheitliches AI-Gateway – eines pro Aufgabe. Dieser Ansatz ermöglicht es dem System, für jeden Anfragettyp das optimale Modell auszuwählen: eine schnelle Chat-Antwort, Code-Generierung, Screenshot-Analyse, System Design oder Einbettungen.
Wann Sie diesen Artikel lesen sollten
Lesen Sie diesen Artikel, um zu verstehen:
- welche Modelle im Hintergrund arbeiten;
- wie sich Pläne hinsichtlich des Modellzugriffs unterscheiden;
- wie Sie das richtige Modell für Ihre Anforderungen auswählen.
Sieben Modellrollen
| Rolle | Zweck | Modelle (Beispiele) |
|---|---|---|
| responses | Chat-Antworten auf Fragen während eines Meetings | Claude Sonnet/Haiku, GPT-4o mini, DeepSeek |
| coding | Code-Erklärung und Snippet-Generierung | DeepSeek Coder, Claude Sonnet, GPT-4o |
| vision | Screenshot- und Bildanalyse | Claude Sonnet mit Vision, GPT-4o Vision |
| system_design | Strukturierte Antwort mit Mermaid-Diagrammen | Claude Opus, GPT-4o |
| generation | Mindmap-Anreicherung, Knotengenerierung | Claude Haiku, GPT-4o mini |
| transcription | Spracherkennung (Whisper) | Whisper |
| embedding | Vektorisierung von Wissensdatenbank-Notizen für RAG | Einbettungsmodell |
Zugriff nach Plan
| Plan | Verfügbare Rollen | Einschränkungen |
|---|---|---|
| Free | responses (Basismodelle) | Nur Basisstufe; 60 Min./Monat |
| Start / Pro | responses, coding, vision, system_design, generation | Große Modellauswahl; keine Frontier-Modelle |
| Max | Alle Rollen + Frontier-Modelle | Claude Opus, flagship GPT, Top-DeepSeek |
Frontier-Modelle sind die leistungsstärksten und teuersten Modelle jedes Anbieters (Claude Opus, GPT-4.1, DeepSeek R1 und Äquivalente). Ausschließlich im Max-Plan verfügbar.
So ändern Sie das Modell
- Öffnen Sie Einstellungen im Client oder im Web-Dashboard (
/app/settings). - Wechseln Sie zum Abschnitt Modelle.
- Wählen Sie für jede Rolle ein Modell aus dem in Ihrem Plan verfügbaren Angebot aus.
- Speichern — die Einstellungen gelten ab der nächsten Sitzung.
Nachdenken
Manche Modelle „denken“ vor der Antwort Schritt für Schritt: bei schwierigen Aufgaben ist das genauer, kostet aber Wartesekunden und abgerechnete Tokens. In jeder Rollenzeile gibt es den Schalter Nachdenken — er erscheint nur bei Modellen, deren Nachdenken sich abschalten lässt. Ein Modell, das immer nachdenkt, zeigt statt des Schalters „immer aktiv“, ein Modell ohne Nachdenken „nicht unterstützt“.
Verfügbare Modellfamilien
Modelle der folgenden Anbieter stehen zur Verfügung:
- Anthropic: Claude Opus, Sonnet, Haiku
- OpenAI: GPT-4o, GPT-4o mini, GPT-4.1
- DeepSeek: DeepSeek V3, Coder, R1
- Alibaba: Qwen
- Google: Gemini Flash, Pro
- xAI: Grok
- Meta: Llama 3
Das verfügbare Modellset wird aktualisiert, sobald neue Modelle hinzugefügt werden.
Häufige Fehler
| Fehler | Ursache | Lösung |
|---|---|---|
| Modell antwortet nicht | Das ausgewählte Modell ist vorübergehend nicht verfügbar | Wechseln Sie zu einem anderen Modell in derselben Rolle |
| „Frontier-Modell nicht verfügbar" | Ihr Plan enthält keine Frontier-Modelle | Upgrade auf Max |
| Antwort ist unerwartet kurz | Ein Modell mit kleinem Kontextfenster wurde ausgewählt | Wechseln Sie zu einem leistungsfähigeren Modell |
Bewährte Vorgehensweisen
- Für schnelle Hinweise während eines Vorstellungsgesprächs verwenden Sie Haiku / GPT-4o mini — Antworten kommen schneller.
- Für System Design wählen Sie Claude Opus oder GPT-4o — sie verarbeiten strukturierte Diagramme besser.
- Für Code ist DeepSeek Coder oft genauer als andere Modelle vergleichbarer Größe.
- Max-Plan mit Frontier-Modellen ist besonders wertvoll für nicht standardisierte Situationen, die maximales Schlussfolgern erfordern.