Agentic Research

Frontier Model(前沿模型)

又稱:前沿模型 · 旗艦模型 · frontier model · SOTA · 最先進模型

某個時間點上能力最頂尖的那一小撮模型 —— 是一個會移動的標籤,不是一個固定的技術規格。

你會在什麼時候遇到它

讀任何模型評測、定價頁、選型文章時,「前沿」「旗艦」「SOTA」這些詞會反覆出現。不懂它的性質,你會把行銷標籤當成技術事實:要嘛無腦選最貴的那個(很多任務根本用不到前沿能力,錢白花),要嘛在每次新模型發布時焦慮地全面重選 —— 而該做的其實是定期用你自己的任務重新評測。

打個比方

像手機的「旗艦機」:發布那天確實最強、最貴;幾個月後被新旗艦超越,降價、改列中階。「旗艦」是貨架上的位置,不是機器的永久屬性 —— AI 模型也一樣,而且換代速度更快。

最小範例

供應商的模型選單通常長這樣(示意):

  前沿/旗艦層   能力最強、單價最高、通常也最慢;
                新能力(更長的上下文、思考模式、多模態、
                更強的 Agent 工具使用)先落在這一層
  中階層        上一代的旗艦,或刻意平衡成本的新模型
  輕量層        最快最便宜,能力上限明顯較低

幾季之後再看同一張選單:層級還在,成員已經換過一輪。

注意「前沿」描述的是相對位置:它永遠指「目前最好的那一層」,所以這個詞本身不攜帶任何絕對能力資訊。去年的前沿,今年可能不如中階 —— 看到這個詞要追問一句:「哪一年的前沿?」

最常搞錯的地方

  • 以為「前沿」等於「最適合你的任務」。前沿是在公開評測的廣泛能力上領先;你的實際工作負載可能窄而具體,中階甚至輕量模型在上面打平或更好,價格卻低得多。沒有自己的評測集,沒人知道答案 —— 供應商也不知道。
  • 拿不同供應商公布的基準分數直接比大小,以為前沿層內部也能這樣排序。評測集的挑選、跑法、甚至資料洩漏程度都不同,分數只在同一套方法下才可比 —— 而廠商各自公布的數字,很少出自同一套方法。

相關詞條

下一步