模型角色與 LLM 訪問權限

Whisperer 透過統一的 AI 閘道器使用多個專用模型——每種任務一個。這種方式讓系統能夠為每類請求選擇最優模型:快速的聊天回覆、程式碼生成、截圖分析、系統設計或向量嵌入。

何時閱讀本文

閱讀本文以瞭解:

  • 底層執行的是哪些模型;
  • 各方案在模型訪問方面有何差異;
  • 如何為你的需求選擇合適的模型。

七種模型角色

角色 用途 模型示例
responses 會議中問題的聊天回答 Claude Sonnet/Haiku、GPT-4o mini、DeepSeek
coding 程式碼解釋和程式碼片段生成 DeepSeek Coder、Claude Sonnet、GPT-4o
vision 截圖和影象分析 Claude Sonnet(帶視覺)、GPT-4o Vision
system_design 帶 Mermaid 圖表的結構化回答 Claude Opus、GPT-4o
generation 思維導圖豐富化、節點生成 Claude Haiku、GPT-4o mini
transcription 語音識別(Whisper) Whisper
embedding 知識庫筆記向量化(用於 RAG) 向量嵌入模型

按方案的訪問權限

方案 可用角色 限制
Free responses(基礎模型) 僅基礎級別;每月 60 分鐘
Start / Pro responses、coding、vision、system_design、generation 廣泛的模型選擇;無前沿模型
Max 所有角色 + 前沿模型 Claude Opus、旗艦 GPT、頂級 DeepSeek

前沿模型是各提供商最強大、最昂貴的模型(Claude Opus、GPT-4.1、DeepSeek R1 及同等產品)。僅在 Max 方案中可用

如何更改模型

  1. 開啟客戶端或網頁控制檯中的設定/app/settings)。
  2. 進入模型部分。
  3. 為每個角色從你所在方案可用的模型中選擇一個。
  4. 儲存——設定將在下一次會話中生效。

推理

部分模型在回答前會「逐步思考」:處理難題時更準確,但會增加等待時間和計費 Token。每個角色行都有 推理 開關,僅在可以關閉推理的模型上顯示。始終推理的模型會顯示「始終開啟」,不推理的模型顯示「不支援」。

可用模型系列

以下提供商的模型可供選擇:

  • Anthropic:Claude Opus、Sonnet、Haiku
  • OpenAI:GPT-4o、GPT-4o mini、GPT-4.1
  • DeepSeek:DeepSeek V3、Coder、R1
  • Alibaba:Qwen
  • Google:Gemini Flash、Pro
  • xAI:Grok
  • Meta:Llama 3

隨著新模型的加入,可用模型集將持續更新。

常見錯誤

錯誤 原因 解決方法
模型無響應 所選模型暫時不可用 切換到同一角色的另一個模型
"前沿模型不可用" 你的方案不包含前沿模型 升級到 Max
回覆意外過短 選擇了上下文視窗較小的模型 切換到更強大的模型

最佳實踐

  • 面試中需要快速提示時,使用 Haiku / GPT-4o mini——響應速度更快。
  • 系統設計選擇 Claude Opus 或 GPT-4o——它們更擅長處理結構化圖表。
  • 編寫程式碼時,DeepSeek Coder 通常比同等規模的其他模型更準確。
  • 配備前沿模型的 Max 方案在需要最強推理能力的非標準場景中尤為有價值。

相關文章