Claude Fable 5 登場即付費 安全閘門擋科研 北京智譜追趕
人工智能初創 Anthropic 昨(9日)正式發布 Claude Fable 5 及 Claude Mythos 5,採用「安全雙版本」策略——Fable 5 向公眾開放,Mythos 5 則僅供信任合作夥伴使用。這被視為該公司繼 4 月 Project Glasswing 後最大規模的模型更新,但不到兩周,Fable 5 已開始向用戶收取額外 Credits,超出基本配額即需付費。與此同時,中國智譜 AI 的 GLM-5.2 在網頁設計基準測試中擊敗 Fable 5,打破西方模型主導局面,為這場 AI 競賽再添變數。
安全掛帥 零越獄違規
Anthropic 形容 Fable 5 是「已做好安全措施、可供一般使用的 Mythos 級模型」。官方數據顯示,在網絡安全惡意查詢測試中,Fable 5 違規次數為零——即使使用 30 種公開越獄技術亦未能繞過防護。但防護背後代價明顯:模型幾乎拒絕回答所有生物及化學相關高風險查詢,相關請求會被轉至較弱的 Opus 4.8 處理。
CNET 在測試後指出,這種「一刀切」安全策略可能嚴重限制模型在科研及教育領域的實用性。一個研究癌症藥物的學者,若試圖用 Fable 5 查詢蛋白質結構,恐怕只會得到「無法回答」的結果。Anthropic 承認正與美國政府磋商,計劃放寬 Mythos 5 的存取權限,但暫時未有時間表。
性能標杆 華頓教授親證寫 Game
撇開安全爭議,Fable 5 的性能確實亮眼。在 CursorBench 軟體工程基準測試中,它創下新標杆,能處理長時間、複雜的編碼任務。賓夕法尼亞大學華頓商學院教授 Ethan Mollick 在社交平台展示,Fable 5 只需一個指令就能生成完整可玩遊戲,包括經典的 Snake、Strata 及 Duino。他形容:「這不再是玩具級 demo,而是真正可上手的遊戲。」
不過,這些成就很快被中國競爭對手挑戰。6 月 20 日,智譜 AI 發布 GLM-5.2,在 Design Arena 的 HTML 網頁設計基準測試中,以 Elo 約 1360 分擊敗 Fable 5,登上非代理類別榜首。值得注意的是,GLM-5.2 採用 Tailwind CSS 的比例高達 91%,顯示其對主流前端框架的熟練程度。Gizmochina 分析認為,這證明中國 AI 實驗室在創意編碼領域正快速追趕。
收費來襲 IPO 前奏
Fable 5 發布當日,用戶仍可免費使用基本配額,但 6 月 23 日 Anthropic 更新使用條款,超出配額即需以 Credits 付費。此舉被市場解讀為公司加速商業化,為首次公開招股(IPO)鋪路。Business Insider 早前披露,Anthropic 已機密提交 S-1 文件,準備追趕 OpenAI 及 SpaceX 的上市步伐。
分析認為,安納克(Anthropic 內部對 Fable 5 安全版本的代號)雖犧牲部分實用性,但零違規紀錄有助說服監管機構及保守投資者。在 AI 安全日益敏感的當下,一個拒絕回答「如何合成神經毒氣」的模型,遠比一個有求必應的模型更易獲得華爾街信任。
尾聲:一場速度與安全的拔河
Fable 5 的誕生,折射出 AI 業界的核心矛盾:要性能還是要安全?要開放還是要監管?Anthropic 選擇了後者,卻在收費的同時,讓競爭對手在特定領域超前。智譜的超越或許只是開始——當美國公司忙於遊說政府、設計安全濾網時,中國團隊正以更快的迭代速度搶佔創意編碼高地。
一個生成 Snake 的模型,不回答蛋白質結構問題。這樣的 AI,到底是進步還是退步?留待市場與時間驗證。