NiceKate AI觀看原文

NiceKate AI:Claude Fable 5 深度實測 — 強是真的強,貴也是真的貴

Kate 深度評測 Claude Fable 5 系列模型,從 Cursor Bench 到複雜前端任務全面比較 GPT 5.5。結論:能力確實頂尖,但價格也確實驚人,安全防護更是令人頭痛。

開場閒聊

Kate 一開場就直接點出重點:「Claude 發布了 Fable 5,強是真的強,貴也是真的貴。」

她指出 Fable 5 和 Mistral 5 是同級別的模型,但面向普通用戶,預設帶安全防護。

價格則是 Opus 模型的兩倍——這是她第一個拋出的震撼彈。

她特別強調,在測試過程中選擇的思考強度越高,模型就「又慢又貴」,雖然質量確實不錯。

這種既讚賞又無奈的語氣,貫穿了整支影片的基調:能力頂尖,但代價驚人。

懶人包速覽

核心痛點 解決方案 / 關鍵觀點
Fable 5 價格昂貴,該選哪個版本? Fable 5 High 和 Medium 最具性價比,Max 最強但最貴,四個版本都超越 GPT 5.5 S High
安全防護太嚴格怎麼辦? Fable 5 對不安全話題會降級到 Opus 4.8,無法繞過,需注意使用情境
Fable 5 跟 GPT 5.5 比到底誰強? 多數基準 Fable 5 勝出,但 token 用量和費用都是 GPT 5.5 的約兩倍
該如何善用 Fable 5 的開發潛力? 搭配 Claude Code 的 Goal 和 Workflow 模式,讓 Claude 持續工作、並行驗證自己的計畫

我花了大約 15 分鐘看完 Kate 的這支實測影片,內容從 Fable 5 的定價策略一路聊到實際前端任務的逐項比較,資訊量非常紮實。這篇文章我幫大家整理出 4 個最關鍵的觀察,並附上我自己在使用 AI 模型上的補充看法。

Fable 5 定價與版本策略:頂尖但昂貴的選擇

Anthropic 這次推出的 Fable 5 系列共有四個版本:Max、High、Medium 以及一個基礎版本。Kate 引用 Cursor Bench 的數據指出,Fable 5 Max 是該排行榜上最先進的模型,但也是最貴的選擇。Fable 5 High 和 Medium 則落在性價比的甜蜜點。

值得留意的是,這四個版本在 Cursor Bench 上都超越了 GPT 5.5 S High。Kate 強調,同樣的任務平均下來,Fable 5 花費的 token 數幾乎是 GPT 5.5 的兩倍,費用也因此是兩倍。以 Cursor Bench 的單一任務為例,Fable 5 High 約花費十美元,而 GPT 5.5 High 僅需三點五美元。

不過 Kate 也提到,從 6 月 23 日起,無論是 Pro 還是 Max 用戶,要使用 Fable 5 都必須啟用額外的用量額度,按 API 計費。在此之前(到 6 月 22 日),Pro 或 Max 會員可以免費試用 Fable 5。

實際前端任務對決:Fable 5 vs GPT 5.5

Kate 針對多個複雜前端任務進行了 side-by-side 比較,選擇的都是 High 推理模式。

在動態字體海報排版機這個任務上,Fable 5 的表現堪稱「吊打 GPT 5.5」。從斜切網格到圓形路徑,從巨型字模裁剪到縱橫混排、密集報紙欄,再到自由散點構圖,每一個設計都非常到位。Kate 給出的評價是「這是我目前測過多個模型裡海報排版機最好的一個設計」。

桌面行星儀的實測同樣令人印象深刻。Fable 5 對各球體的質感處理非常高級,上方的球移動時,下方有影子跟隨。點擊綠色琉璃球時,玻璃反射效果真實,滾動時也有細膩的光影變化。Kate 唯一指出的小缺點是齒輪位置擺錯了,以及左上方的燈雖然光線質感極佳但位置略顯突兀。

在迷你印表機任務上,Fable 5 理解了「活字排版」的概念——這點是其他模型常犯的錯誤(字模做成鏡像效果)。不過 Kate 也發現一個問題:文字應該是突出來的而非凹進去,最終還是有些許錯誤。壓印動畫的效果則相當不錯。

Kate 也特別測試了 Claude Code 搭配 Fable 5 High 生成的「纖夫拉船」場景——她表示這是她測試過眾多模型中最出色的表現之一。

水流模仿非常到位,畫面中的遠山、江面上的飛鳥都處理得很好。

尤其值得一提的是,繩索綁定在船上、船上安排了船夫這兩個細節,是 GPT 5.5 Pro 都忽略掉的。

仔細觀察每個船夫的走姿,非常有動感且真實。Kate 還讓 Claude Code 做了一個「森林露營房車」的體術藝術展示——畫面細節豐富,露營小車的車輪、展開的棚子、旁邊的小桌子都展現得很好。

畫面中還有許多小花的元素,房車屋頂有額外的工具,光線透過森林縫隙灑下,營造出非常貼近現實生活的氛圍。

最後她還發現一個彩蛋——畫面中出現了一個以前測試從未出現的新人物,讓測試過程增添了不少趣味。

Fable 5 的安全防護:過猶不及

Kate 對 Fable 5 的安全防護機制表達了相當大的無奈。她指出,Fable 5 的防護「實在是太厲害了」,只要模型認為話題涉及不安全的網絡問題、生物化學或真流風險,就會直接將模型降級退回 Opus 4.8。

這個設計帶來的問題是:花了更貴的價格,反而用上一個較舊的模型。Kate 直言「這個就非常非常令人討厭了」。此外,與 Fable 5 的對話數據只保留 30 天,對於需要長期跟蹤實驗結果的用戶來說是一個需要留意的限制。

Anthropic 官方對此的建議是:不要讓 Fable 5 重述推理過程,因為這是他們防止真流模型的機制之一。這意味著使用者在 prompt 設計上需要多花一些心思來繞過這個限制。

Claude Code 整合與開發者啟示

Kate 也分享了 Anthropic 工程師關於 Fable 5 使用方式的觀點。過去,團隊主要驗證 Claude 是否把工作做對了——需要手動拆分任務、主快、檢查輸出、捕捉提前停止的問題。但現在,團隊更多是在驗證 Claude 是否在做正確的工作。

工程師的建議是:把 Fable 5 當作思考夥伴,不再只是下指令,而是在早期就讓它參與思考。給它一個小的 Spec,然後讓 Claude 採訪你來實現細節。將 Fable 5 和 Claude Code 的 Goal 與 Workflow 結合起來,讓 Claude 持續工作、並行驗證自己的計畫。

Kate 特別提到一個很好的建議:Fable 5 讓團隊勇於嘗試過去認為大模型做不到的任務。她的建議是「把那些看起來不可能的任務,也讓 Fable 5 來試試」。

QA 精選

Q1:Fable 5 的價格到底比 GPT 5.5 貴多少?

從 Kate 的實測數據來看,在 Cursor Bench 的單一任務上,Fable 5 High 約花費十美元,而 GPT 5.5 High 僅需三點五美元,差了將近三倍。

從 token 用量來看,同樣的任務 Fable 5 消耗的 token 數幾乎是 GPT 5.5 的兩倍,費用也因此翻倍。

這還不考慮 Fable 5 的安全降級機制——如果被降級到 Opus 4.8,等於花了 Fable 5 的錢卻用了較差的模型。

Q2:Fable 5 哪個版本最值得買?

Kate 的推薦是:如果只是日常任務,Fable 5 High 和 Medium 是最具性價比的選擇。

它們在 Cursor Bench 上都超越 GPT 5.5 S High,價格卻比 Max 版本實惠很多。

Max 版本雖然最強,但價格也是最貴的,適合對品質要求極高的場景。

Kate 自己也提到,Max 版本在桌面行星儀等視覺任務上「效果應該會好更多」,但她主要使用的是 High 模式進行測試。

Q3:Fable 5 的安全防護會影響日常使用嗎?

會的,而且影響不小。Kate 在影片中明確表示,只要話題涉及不安全網絡、生物化學或真流風險,Fable 5 就會自動降級到 Opus 4.8。

這代表如果你在做 AI 安全研究或生物醫藥相關的工作,花了 Fable 5 的價格卻無法享受 Fable 5 的能力。

Kate 的建議是:注意使用情境,避免觸發安全降級機制。

Q4:Fable 5 在開發工作流中的最佳用法是什麼?

根據 Anthropic 工程師的分享,Fable 5 最適合扮演思考夥伴的角色——不是等指令再執行,而是在早期就參與討論。

具體做法是:給 Fable 5 一個小規格(Spec),讓它反過來採訪你,把需求細節補齊。

然後結合 Claude Code 的 Goal 和 Workflow 模式,讓 Claude 持續執行並並行驗證自己的計畫。

Kate 認為這是 Fable 5 最有潛力的使用方式,也是她最推薦開發者嘗試的方向。

Q5:Fable 5 的免費試用期到什麼時候?

到 6 月 22 日為止。在此之前,只要你是 Pro 或 Max 會員,就可以使用 Fable 5。

從 6 月 23 日起,無論是 Pro 還是 Max 用戶,使用 Fable 5 都必須啟用額外的用量額度,按 API 計費。

Kate 強烈建議大家趁這段免費試用期好好體驗 Fable 5,因為一旦正式計費,測試成本會大幅上升。

主編隨筆

Kate 在影片中把重點放在 Fable 5 和 GPT 5.5 的逐項比較,數據非常具體,這對正在選型的開發者確實有很高的參考價值。

但我想補充一個 Kate 沒提到的面向:模型的安全性與實用性之間的平衡,可能比效能差距更重要。

從 Fable 5 的降級機制可以看出,Anthropic 在安全策略上走得非常前面,甚至可以說是過度保守。

這讓我不禁想到一個實際問題:如果你是一家做 AI 安全產品的公司,買了 Fable 5 卻發現所有相關 prompt 都被降級到 Opus 4.8,那你花這筆錢的意義在哪裡?反觀 GPT 5.5 雖然在部分基準測試上略遜一籌,但至少不會因為話題敏感就自動降級。

以我自己的使用經驗來說,模型的「可用性」往往比「理論極限」更重要。

Fable 5 的視覺能力和程式碼生成確實令人驚豔,但如果開發過程中頻繁被安全降級打斷,生產力反而會下降。

我建議團隊在選型時,不只比較 Cursor Bench 的分數,更要實際跑一遍自己的開發場景——特別是那些「稍微敏感一點」的任務。真正的答案往往藏在實際使用中,而不是榜單數字裡。

結語

Kate 的這支影片以一貫的實測風格,提供了 Fable 5 和 GPT 5.5 之間非常具體的對比數據。

結論很清楚:Fable 5 確實是目前最強的前端生成模型之一,但它的價格和安全防護機制讓它不是適合所有人的選擇。

如果你是 Pro 或 Max 會員,不妨趁 6 月 22 日前的免費試用期親自體驗看看。

如果你是開發團隊正在選型,我的建議是把 Fable 5 和 GPT 5.5 都跑過一遍自己的典型任務,然後用「每任務美元成本」來衡量——而不是只看誰的 Cursor Bench 分數更高。

本文章僅作為學習與交流用途,不構成任何投資建議。 原始內容版權歸原節目製作人所有。本網站內容經 AI 輔助整理,並經人工審核後發布,可能仍包含錯誤。 詳見 版權聲明與免責條款