
NiceKate AI:實測 Grok 4.5 VS GPT 5.5 — 又好又快的新一代模型
Keda 實測 Grok 4.5 在編碼、多模態生成與工具調用上的真實表現,並與 GPT 5.5 Hi、Fable 5 Max 進行多輪對比。Grok 4.5 以極快的速度和相對親民的價格提供了接近旗艦模型的體驗。
共 7 篇

Keda 實測 Grok 4.5 在編碼、多模態生成與工具調用上的真實表現,並與 GPT 5.5 Hi、Fable 5 Max 進行多輪對比。Grok 4.5 以極快的速度和相對親民的價格提供了接近旗艦模型的體驗。

葉展實測 Fable 5 High 模式在 6 大真實任務中的表現,從 3D 建模、電商網頁到中國書畫美術館 WebGL 應用,並與 GPT-5.5、Solid 5 逐一對比,結論是 Fable 5 速度快且成功率高,足以改變工作流程。

Gary 分享一套跨模型自動審稿系統,讓 Claude 與 Codex 互相 review 程式碼,透過 StopHook、Skill 與 Marker 三層架構實現全自動的實作計劃審查流程,徹底解放 solo developer 的生產力瓶頸。

Claude Fable 5 從發布到被美國政府勒令下架僅 72 小時。本文整理 Fable 5 的真實能力、與其他模型的 benchmark 對比、使用技巧,以及背後三大陰謀論解析。

Gary 深度解析 Claude Dynamic Workflow 的核心運作原理,以及它與 Subagent、Agent Team、Skill、Go 指令的關鍵差異,並分享實戰使用場景與節省成本的三個技巧。

Kate 實測 Claude Opus 4.7,從 SWE-Bench Pro 編碼基準到多個前端 Demo 全面測試,發現 Opus 4.7 的視覺能力與前端設計大幅提升,在多項實測中超越 GPT-5.4 與 Kimi K2.6。

GSD 2 將 AI Coding Agent 從提示詞升級為可運維的系統——狀態機驅動、崩潰恢復、預算控制、驗證管線,讓開發者真正可以「跑起來就走開」。