模型選單加入計分卡:AI 正在變成可以隨時換的零件

三星期內三家公司各發布一個新模型。對一般用家而言,跟著記名字與版本號沒有意義——真正的轉變是,模型正在變成可以隨時換的零件。

AI News Notion 官方版本說明
學員在電腦前輸入指令,屏幕顯示對話介面
要換的只是選單裡那一項,不是整套流程。

改了甚麼?

Notion 在 8 月 14 日改版模型選單。三項改動:

模型選單三項改動
  • 先列出適合處理難題的幾個模型,不用自己在長清單裡找。
  • 每個模型附一張計分卡,比較速度、智能與成本三項。
  • 可以 pin 起常用的那一個;需要時亦可以調高 effort,換一個更仔細的答案。

為甚麼會出現這種介面?

因為過去兩個月,新模型的發布速度已經快到記不住。

近月的模型發布
  • Anthropic 發布 Claude Opus 5(7 月 24 日)。
  • xAI 發布 Grok 4.6(8 月 12 日)。
  • Google 發布 Gemini 3.7 Flash(8 月 13 日)。

三家公司在三星期內各推一個。對一般用家而言,跟著記名字與版本號沒有意義——因為下個月又會有新的。

真正的轉變是:模型正在變成可以隨時換的零件。

你在 Notion 裡寫的指令、建的資料庫、設的 Agent,不會因為換了底層模型而要重做。要換的只是選單裡那一項。

演講廳全景:前方大屏幕與講台,座位分排排開,少數參加者坐在座位上
追版本號沒有意義;把自己的流程建穩,換模型只是換選單裡那一項。

計分卡應該怎樣讀?

三項指標各自對應一種工作,實務上可以這樣分:

  1. 速度快、成本低的——用來做量多而簡單的事:整理格式、抽重點、改語氣、翻譯。
  2. 智能高的——用來做要判斷的事:分析一份資助指引、比較兩個方案、寫一份要對外的文件初稿。
  3. 成本欄——如果機構用的是有用量限制的方案,這一欄決定你一個月可以跑多少次。

最常見的浪費,是所有事都用最強那一個。把一份會議紀錄改成書面語,用最貴的模型,結果與便宜的分別不大,但用量會很快見底。

effort 調高,甚麼時候值得?

調高 effort 等於叫它想久一點,換一個更仔細的答案。代價是慢,而且用量計得多。

我們的建議是只在兩種情況下調高:

  • 答案要拿出去見人——例如給校董會的摘要、給資助方的說明。
  • 問題本身有多層——例如「這份指引與我們去年的做法有哪幾處對不上」。

日常整理與草稿,維持預設就夠。調高 effort 不會令錯的資料變成對,只會令它答得長一點。

機構應該怎樣定?

與其讓每位同事各自摸索,不如訂一條很短的內部指引:

  1. 預設用哪一個——pin 起,全機構一樣。
  2. 哪三類工作可以轉用強的那個——寫出來,不要靠感覺。
  3. 誰看用量——每月看一次,超了才調整。

三行就寫得完,但可以省掉「為甚麼今個月用量爆了」這種事後追查。公司要從哪個流程開始整理,我們在公司「AI 化」應該由哪個流程開始寫過。

常見問題

揀邊個模型,係咪越貴越好?

不是。量多而簡單的工作用快而便宜的,結果分別很小,用量卻省很多。真正需要判斷的工作才值得用強的那個。把所有事都交給最強的模型,是最常見的浪費。

effort 調高咗,答案會唔會準啲?

會仔細一點,但不會把錯的資料變成對的。它處理的是思考深度,不是事實核對。要拿出去見人的內容,仍然要有人核對數字與名稱。

新模型出得咁快,我哋係咪要跟住換?

不需要跟。你在 Notion 裡建的指令、資料庫與 Agent 不會因為換了底層模型而要重做——要換的只是選單裡那一項。與其追版本,不如把自己的流程建穩。

企業NGO學校成人學員
資料來源
  • Notion 官方版本說明〈What’s New〉(2026 年 8 月 14 日)。
  • LLM Gateway 模型發布時間線(Claude Opus 5、Grok 4.6、Gemini 3.7 Flash 發布日期)。
下一步

如果想為團隊訂一條「甚麼工作用哪個模型」的內部指引,可以把現時最常做的幾類工作告訴我們。

← 返回 AI 新聞