模型角色與 LLM 訪問權限
Whisperer 透過統一的 AI 閘道器使用多個專用模型——每種任務一個。這種方式讓系統能夠為每類請求選擇最優模型:快速的聊天回覆、程式碼生成、截圖分析、系統設計或向量嵌入。
何時閱讀本文
閱讀本文以瞭解:
- 底層執行的是哪些模型;
- 各方案在模型訪問方面有何差異;
- 如何為你的需求選擇合適的模型。
七種模型角色
| 角色 | 用途 | 模型示例 |
|---|---|---|
| responses | 會議中問題的聊天回答 | Claude Sonnet/Haiku、GPT-4o mini、DeepSeek |
| coding | 程式碼解釋和程式碼片段生成 | DeepSeek Coder、Claude Sonnet、GPT-4o |
| vision | 截圖和影象分析 | Claude Sonnet(帶視覺)、GPT-4o Vision |
| system_design | 帶 Mermaid 圖表的結構化回答 | Claude Opus、GPT-4o |
| generation | 思維導圖豐富化、節點生成 | Claude Haiku、GPT-4o mini |
| transcription | 語音識別(Whisper) | Whisper |
| embedding | 知識庫筆記向量化(用於 RAG) | 向量嵌入模型 |
按方案的訪問權限
| 方案 | 可用角色 | 限制 |
|---|---|---|
| Free | responses(基礎模型) | 僅基礎級別;每月 60 分鐘 |
| Start / Pro | responses、coding、vision、system_design、generation | 廣泛的模型選擇;無前沿模型 |
| Max | 所有角色 + 前沿模型 | Claude Opus、旗艦 GPT、頂級 DeepSeek |
前沿模型是各提供商最強大、最昂貴的模型(Claude Opus、GPT-4.1、DeepSeek R1 及同等產品)。僅在 Max 方案中可用。
如何更改模型
- 開啟客戶端或網頁控制檯中的設定(
/app/settings)。 - 進入模型部分。
- 為每個角色從你所在方案可用的模型中選擇一個。
- 儲存——設定將在下一次會話中生效。
推理
部分模型在回答前會「逐步思考」:處理難題時更準確,但會增加等待時間和計費 Token。每個角色行都有 推理 開關,僅在可以關閉推理的模型上顯示。始終推理的模型會顯示「始終開啟」,不推理的模型顯示「不支援」。
可用模型系列
以下提供商的模型可供選擇:
- Anthropic:Claude Opus、Sonnet、Haiku
- OpenAI:GPT-4o、GPT-4o mini、GPT-4.1
- DeepSeek:DeepSeek V3、Coder、R1
- Alibaba:Qwen
- Google:Gemini Flash、Pro
- xAI:Grok
- Meta:Llama 3
隨著新模型的加入,可用模型集將持續更新。
常見錯誤
| 錯誤 | 原因 | 解決方法 |
|---|---|---|
| 模型無響應 | 所選模型暫時不可用 | 切換到同一角色的另一個模型 |
| "前沿模型不可用" | 你的方案不包含前沿模型 | 升級到 Max |
| 回覆意外過短 | 選擇了上下文視窗較小的模型 | 切換到更強大的模型 |
最佳實踐
- 面試中需要快速提示時,使用 Haiku / GPT-4o mini——響應速度更快。
- 系統設計選擇 Claude Opus 或 GPT-4o——它們更擅長處理結構化圖表。
- 編寫程式碼時,DeepSeek Coder 通常比同等規模的其他模型更準確。
- 配備前沿模型的 Max 方案在需要最強推理能力的非標準場景中尤為有價值。