Ruoli dei modelli e accesso agli LLM
Whisperer utilizza diversi modelli specializzati attraverso un gateway AI unificato — uno per ogni attività. Questo approccio consente al sistema di selezionare il modello ottimale per ciascun tipo di richiesta: una risposta rapida in chat, la generazione di codice, l'analisi di screenshot, il System Design o gli embedding.
Quando leggere questo articolo
Leggi questo articolo per capire:
- quali modelli lavorano dietro le quinte;
- come differiscono i piani in termini di accesso ai modelli;
- come scegliere il modello giusto per le tue esigenze.
Sette ruoli dei modelli
| Ruolo | Scopo | Modelli (esempi) |
|---|---|---|
| responses | Risposte in chat alle domande durante una riunione | Claude Sonnet/Haiku, GPT-4o mini, DeepSeek |
| coding | Spiegazione del codice e generazione di snippet | DeepSeek Coder, Claude Sonnet, GPT-4o |
| vision | Analisi di screenshot e immagini | Claude Sonnet con vision, GPT-4o Vision |
| system_design | Risposta strutturata con diagrammi Mermaid | Claude Opus, GPT-4o |
| generation | Arricchimento delle mappe mentali, generazione di nodi | Claude Haiku, GPT-4o mini |
| transcription | Riconoscimento vocale (Whisper) | Whisper |
| embedding | Vettorizzazione delle note della knowledge base per RAG | Modello di embedding |
Accesso in base al piano
| Piano | Ruoli disponibili | Limitazioni |
|---|---|---|
| Free | responses (modelli base) | Solo livello base; 60 min/mese |
| Start / Pro | responses, coding, vision, system_design, generation | Ampia selezione di modelli; nessun modello di frontiera |
| Max | Tutti i ruoli + modelli di frontiera | Claude Opus, GPT di punta, DeepSeek top |
I modelli di frontiera sono i modelli più potenti e costosi di ciascun provider (Claude Opus, GPT-4.1, DeepSeek R1 ed equivalenti). Disponibili esclusivamente nel piano Max.
Come cambiare il modello
- Apri le Impostazioni nel client o nella dashboard web (
/app/settings). - Vai alla sezione Modelli.
- Per ciascun ruolo, seleziona un modello tra quelli disponibili nel tuo piano.
- Salva — le impostazioni si applicano alla sessione successiva.
Ragionamento
Alcuni modelli «ragionano passo dopo passo» prima di rispondere: sui compiti difficili è più preciso, ma aggiunge secondi di attesa e token fatturati. In ogni riga di ruolo c'è l'interruttore Ragionamento: compare solo per i modelli il cui ragionamento può essere disattivato. Un modello che ragiona sempre mostra «sempre attivo» al posto dell'interruttore, uno che non ragiona «non supportato».
Famiglie di modelli disponibili
Sono disponibili modelli dei seguenti provider:
- Anthropic: Claude Opus, Sonnet, Haiku
- OpenAI: GPT-4o, GPT-4o mini, GPT-4.1
- DeepSeek: DeepSeek V3, Coder, R1
- Alibaba: Qwen
- Google: Gemini Flash, Pro
- xAI: Grok
- Meta: Llama 3
L'insieme dei modelli disponibili viene aggiornato man mano che ne vengono aggiunti di nuovi.
Errori comuni
| Errore | Causa | Soluzione |
|---|---|---|
| Il modello non risponde | Il modello selezionato è temporaneamente non disponibile | Passa a un altro modello dello stesso ruolo |
| "Modello di frontiera non disponibile" | Il tuo piano non include i modelli di frontiera | Effettua l'upgrade a Max |
| La risposta è inaspettatamente breve | È stato selezionato un modello con una finestra di contesto ridotta | Passa a un modello più capace |
Buone pratiche
- Per suggerimenti rapidi durante un colloquio usa Haiku / GPT-4o mini — le risposte arrivano più velocemente.
- Per il System Design scegli Claude Opus o GPT-4o — gestiscono meglio i diagrammi strutturati.
- Per il codice DeepSeek Coder è spesso più preciso di altri modelli di dimensioni comparabili.
- Il piano Max con i modelli di frontiera è particolarmente prezioso per situazioni non standard che richiedono il massimo del ragionamento.