一張模型能力對比圖最近在知乎與各社羣平臺之間流傳。表格裡是幾十列模型名稱,名字後面跟著分數與長短不一的橫條,依強弱排列整齊。圖上其實什麼標記都沒有,但留言區的讀者都知道該往哪裡看:在 Qwen3.8-27B 那一列附近,有一條看不見的水平線。線以上的模型繼續有存在的理由,線以下的模型,發布即失去談資。有人替這條線起了名字,叫模型斬殺線,知乎上的熱門提問直接以它為題。
線是讀者畫的
任何一張官方榜單都不會畫這條線。競技場式的勝率排行也好,媒體整理的評測對比表也好,表格的設計者只負責提供排序、分數與長條比例,從不暗示切割。線是讀者集體畫上去的,畫的位置取決於共識,而這次的共識落在 Qwen3.8-27B 上。理由並不神祕:這個模型開放權重,可以免費下載,能力卻壓過一批按用量收費的閉源服務。它在榜單上的那一列,於是成了分水嶺。排在它下方還想收費的服務,都得回答同一個問題:使用者的錢,到底買到了線以上的什麼。
設計裡向來有這種不存在的線。考卷的及格線,匯率的整數關卡,技術分析圖上的支撐線與壓力線,軟體都不會替你畫,使用者自己畫。畫的人夠多,線就開始起作用,甚至反過來引導行為。模型斬殺線是同一類產物,差別在於它的移動週期以週計,而且方向只有一個。
從血條借來的詞
斬殺線是遊戲圈的老詞。對戰遊戲裡,血條是一根橫向的量條,血量掉到某個程度,量條由綠轉紅。當數值低到對手一輪傷害就能結束比賽,那個數值就是斬殺線。爐石戰記玩家在對手的回合默默心算它,MOBA 玩家盯著殘血的目標安排技能順序。血條旁浮出的傷害數字、最後一擊的畫面震動,都在強化那條線的存在感。
這個詞搬進模型圈,連視覺記憶一起帶了過來:橫向的量條,轉紅的警示色。更關鍵的是它附帶的判斷方式。模型榜單本是連續的分數世界,相鄰兩名差個一兩分,誤差範圍內外可以爭論半天,換成實際使用體感,差距往往說不清楚。斬殺線跳過這些細膩之處,直接給出二值判斷:線上,或線下。傳播的規律向來如此,開關比滑桿好講,一刀比漸變好傳。
命名裡的兩組數字
Qwen3.8-27B 這個名字本身就是一份排版。品牌字之後,連字號的左邊是版本號 3.8,右邊是參數量 27B。一組數字管時間,說明它在系列演進裡的位置;一組數字管體積,二百七十億個參數。開源社羣的命名普遍遵守這套文法,熟悉的人掃一眼名稱,就能完成兩個判斷:多新,多重。
版本號用小數點推進,修辭上強調的是延續,同一條產品線的又一次打磨。輿論卻用斬殺來描述它。命名語言與話題語言在這裡出現有趣的反差:官方敘事說漸進,社羣敘事偏愛切割。
體積那組數字在實用層面更關鍵。27B 落在一個微妙的量級,大到足以逼近閉源旗艦的能力區間,小到一臺裝了工作站級顯示卡的電腦就能承載,權重經過量化壓縮之後,部署門檻還能再往下探。選在這個規模發力,等於同時對兩種人說話:把任務交給雲端 API 的使用者,以及堅持資料不出門、要自己架的本地端使用者。
實際部署的畫面也值得看。權重檔案以數十 GB 計,下載時終端機裡的進度條一格一格前進,完成後模型在本地回應第一個問題。對許多技術愛好者,這個過程的意義接近組裝:模型從雲端服務變成一件安裝在自己機器上的東西。開源把模型從服務還原為物件,斬殺線的比較之所以成立,正因為開源與閉源已經可以被放上同一張桌。
榜單排版與封面修辭
模型圈可能是當代最依賴表格的技術社羣,榜單的視覺語言已經高度成熟。分數欄用等寬字型,小數右對齊,長條依分數伸展,嚴謹些的榜單還會標上置信區間的誤差線。這套排版的目的是建立可比性,而斬殺線正是長在可比性上的判斷。
誤差線值得多看一眼。它提醒讀者,相鄰名次的差距可能落在雜訊之內,分數的領先未必等於體感的領先。斬殺線的修辭剛好繞開這層謹慎,不處理誤差,直接宣佈位置。專業排版供給細節,大眾修辭供給記憶點,兩套系統各自服務不同的讀者。
同一套邏輯也出現在評測內容的封面上。模型評測影片與圖文的封面常見左右分欄的對比構圖,兩個名字各佔半邊,中間壓一個動詞,吊打、碾壓這一類。這些動詞共享同一個來源:競技轉播與遊戲實況的語彙庫。AI 模型的能力比較,在傳播層面已經長成一場場賽事的視覺格式,有對陣圖,有勝負語法,自然也有屬於它的斬殺線。
價格表上的參考底價
斬殺線真正的施力點在價格表。開源模型把某個能力水準變成零元之後,閉源服務的費率欄就有了參考底價。使用者端的計算很樸素:同樣的任務,一邊免費且可自架,一邊按 Token 計費,差距就得靠能力或服務品質來補。這與我們先前拆解過的DeepSeek 再度調價的計費設計屬於同一條脈絡:模型廠把價格當介面來經營,尖離峯時段與階梯費率,都是把定價做成排程的手法。免費模型的每一次升級,都在替收費服務重畫成本結構。
對應的防禦設計也趨於標準化,常見的有更快的回應速度與更深的產品整合。模型能力本身難以差異化之後,包裝層的設計權重跟著上升,費率表、服務等級、開發者文件,每一處都成了需要經營的介面。
線會往上移
這條線沒有固定的座標。去年的斬殺線畫在規模更小、能力更弱的模型上,每一條新線出現,舊線跟著失效。這個詞的流行本身說明了節奏:模型的更新週期已經短到需要一條會移動的參考線來描述。
對使用者,這是難得的好消息。免費可用能力的水位持續上抬,去年需要付費訂閱才能完成的任務,今年一張顯示卡就能處理。對模型廠,這是一場沒有終局的壓力測試,產品設計的重心持續從模型本身移向回應速度、穩定性與介面整合。蘋果把 AI 助手以 Early Preview 之名收進Apple Store App 的 AI 助手介面設計,就是這層邏輯的展示:底層模型誰強誰弱是一回事,使用者握在手裡的體驗是另一回事,而使用者最終記得的是後者。
回到那張沒有標記的對比圖。斬殺線不在任何官方榜單上,卻比榜單上任何一列都更有影響力。一條看不見的線,加一個從遊戲借來的詞,把一整個產業的比較焦慮壓縮成一眼可讀的畫面,這是社羣自發完成的一次介面設計。至於線的下一站落在哪個名字上,榜單會比我們先知道。