Roles de modelo y acceso a LLM
Whisperer utiliza varios modelos especializados a través de una pasarela de IA unificada — uno por tarea. Este enfoque permite al sistema seleccionar el modelo óptimo para cada tipo de solicitud: una respuesta rápida de chat, generación de código, análisis de capturas de pantalla, System Design o embeddings.
Cuándo leer este artículo
Lee este artículo para entender:
- qué modelos trabajan en segundo plano;
- cómo difieren los planes en cuanto al acceso a los modelos;
- cómo elegir el modelo adecuado para tus necesidades.
Los siete roles de modelo
| Rol | Propósito | Modelos (ejemplos) |
|---|---|---|
| responses | Respuestas de chat a preguntas durante una reunión | Claude Sonnet/Haiku, GPT-4o mini, DeepSeek |
| coding | Explicación y generación de fragmentos de código | DeepSeek Coder, Claude Sonnet, GPT-4o |
| vision | Análisis de capturas de pantalla e imágenes | Claude Sonnet con vision, GPT-4o Vision |
| system_design | Respuesta estructurada con diagramas Mermaid | Claude Opus, GPT-4o |
| generation | Enriquecimiento del mapa mental, generación de nodos | Claude Haiku, GPT-4o mini |
| transcription | Reconocimiento de voz (Whisper) | Whisper |
| embedding | Vectorización de notas de la base de conocimiento para RAG | Modelo de embedding |
Acceso por plan
| Plan | Roles disponibles | Limitaciones |
|---|---|---|
| Free | responses (modelos básicos) | Solo nivel básico; 60 min/mes |
| Start / Pro | responses, coding, vision, system_design, generation | Amplia selección de modelos; sin modelos frontier |
| Max | Todos los roles + modelos frontier | Claude Opus, GPT de primera línea, DeepSeek top |
Los modelos frontier son los modelos más potentes y costosos de cada proveedor (Claude Opus, GPT-4.1, DeepSeek R1 y equivalentes). Disponibles exclusivamente en el plan Max.
Cómo cambiar el modelo
- Abre Configuración en el cliente o en el panel web (
/app/settings). - Ve a la sección Modelos.
- Para cada rol, selecciona un modelo del conjunto disponible en tu plan.
- Guarda — la configuración se aplica a la próxima sesión.
Razonamiento
Algunos modelos «piensan paso a paso» antes de responder: es más preciso en tareas difíciles, pero añade segundos de espera y tokens facturados. Cada fila de rol tiene el interruptor Razonamiento, que aparece solo en los modelos cuyo razonamiento puede desactivarse. Un modelo que siempre razona muestra «siempre activo» en lugar del interruptor, y uno que no razona, «no compatible».
Familias de modelos disponibles
Están disponibles modelos de los siguientes proveedores:
- Anthropic: Claude Opus, Sonnet, Haiku
- OpenAI: GPT-4o, GPT-4o mini, GPT-4.1
- DeepSeek: DeepSeek V3, Coder, R1
- Alibaba: Qwen
- Google: Gemini Flash, Pro
- xAI: Grok
- Meta: Llama 3
El conjunto de modelos disponibles se actualiza a medida que se añaden nuevos modelos.
Errores comunes
| Error | Causa | Solución |
|---|---|---|
| El modelo no responde | El modelo seleccionado no está disponible temporalmente | Cambia a otro modelo en el mismo rol |
| "Modelo frontier no disponible" | Tu plan no incluye modelos frontier | Actualiza a Max |
| La respuesta es inesperadamente corta | Se seleccionó un modelo con una ventana de contexto pequeña | Cambia a un modelo más capaz |
Buenas prácticas
- Para pistas rápidas durante una entrevista usa Haiku / GPT-4o mini — las respuestas llegan más rápido.
- Para System Design elige Claude Opus o GPT-4o — manejan mejor los diagramas estructurados.
- Para código DeepSeek Coder suele ser más preciso que otros modelos de tamaño comparable.
- El plan Max con modelos frontier es especialmente valioso para situaciones no estándar que requieren el máximo razonamiento.