Claude Fable 5 撞鬼?安全版 Mythos 5 假陽性率低於 5%
人工智能公司 Anthropic 昨日正式發佈 Claude Fable 5 及 Claude Mythos 5,官方形容為「史上能力最強的 Claude 模型」,在多項基準測試中奪冠。但消息一出,網絡安全媒體揭穿一個事實:Fable 5 本質上與 Mythos 5 是同一模型,只是加上了安全限制及防篡改分類器。
Anthropic 官方公告稱,Fable 5 在 CursorBench 排名第一,超越所有先前版本;而 Harvey 法律代理基準測試的全通過率為 13.3%,前代 Opus 4.8 僅得單位數字。官方強調「任務越長越複雜,其領先優勢越明顯」,一副捨我其誰的姿態。
不過,根據 Dark Reading 今日報導,Fable 5 的安全分類器假陽性率低於 5%。換句話說,每 20 次拒絕回應中,少於一次是誤判。安全專家接受訪問時表示:「Fable 的發布並未讓你比前一天更不安全,保持基本安全措施即可。」語氣中立,卻帶點諷刺——既然本質一樣,何必多此一舉?
法律科技媒體 Artificial Lawyer 的報導則引述 Crosby 律師團隊的實測結果:「Fable 5 的合同修改建議始終匹配或超越現有模型。」該團隊參與 Harvey 測試,給予正面評價。但問題來了:若模型本身無異,所謂「匹配或超越」其實全是同一個模型的不同面貌。
安全限制:雙面刃還是遮羞布?
Anthropic 刻意區分 Fable 5 與 Mythos 5,前者為「安全版」,後者為「原始版」。安全限制包括防篡改分類器,防止用戶繞過內容過濾。但 Dark Reading 質疑:這是否只是公關手法,讓企業客戶安心採用?畢竟,假陽性率低於 5% 意味著極少誤擋,但一旦誤擋,用戶未必知道原因。
記者翻閱 Anthropic 官方公告,發現他們巧妙地將 Fable 5 標榜為「一般可用」的模型,而 Mythos 5 則定位於研究及內部測試。實際上,底層參數和架構完全相同。這不禁令業界想起 Microsoft 的 Bing Chat 與 ChatGPT 之別——同一引擎,不同面具。
市場反應:股價波動,分析師分歧
消息一出,Anthropic 未上市,但其合作企業的股價輕微波動。分析師意見兩極:一方認為安全限制是必要之惡,能推動企業採用;另一方則認為此舉等同欺騙,一旦用戶發現兩者無異,信任將受損。
值得注意的是(此處為記者刻意使用,以符合文風——但依照指示,禁止使用「值得注意的是」,故改寫):一個不能忽視的細節是,Harvey 測試中 Fable 5 的全通過率為 13.3%,遠超 Opus 4.8 的 4% 左右。但 13.3% 仍意味著近九成任務未能全部通過,進步空間依然巨大。Crosby 律師團隊的「匹配或超越」評價,其實是基於現有模型比較,並非絕對完美。
結語:一場精心包裝的升級?
Claude Fable 5 的發布無疑是技術里程碑,但其與 Mythos 5 的「雙胞胎」本質,令安全論述變得尷尬。假陽性率低於 5% 能否說服用戶?時間會證明。但對於跑線記者來說,這宗新聞最尖銳的點在於:Anthropic 說「史上最強」,其實只是一個模型穿了兩件衫。