
NiceKate AI:超越編碼·AI上手操作電腦|Codex大更新實測
OpenAI Codex 推出重大更新,內置瀏覽器與電腦操作功能正式上線。實際測試發現,Codex 的計算機使用能力遠超 Claude,能操作 X 發文、Typora 寫作、Keynote 做簡報、甚至操控第三方 AI 繪圖 App。

OpenAI Codex 推出重大更新,內置瀏覽器與電腦操作功能正式上線。實際測試發現,Codex 的計算機使用能力遠超 Claude,能操作 X 發文、Typora 寫作、Keynote 做簡報、甚至操控第三方 AI 繪圖 App。

Kate 實測 Claude Opus 4.7,從 SWE-Bench Pro 編碼基準到多個前端 Demo 全面測試,發現 Opus 4.7 的視覺能力與前端設計大幅提升,在多項實測中超越 GPT-5.4 與 Kimi K2.6。

凱潔深度實測 Gemini 3.1 Flash TTS:價格只要 ElevenLabs 的零頭,支援多說話人對白、70+ 語言、自然語言控制音色與情緒。本文附完整提示詞教學與 Hermes 整合實戰。

K 實測 Kimi K2.6 Code Preview 在色彩理論動畫、3D 場景、體素藝術等 9 項任務的真實表現,並對比 Gemini 3.1 Pro 的魔術方塊變形效果。同時展示透過 Hermes Agent 整合 Kimi 來管理磁碟空間的實際應用。

傑錢分享訂閱 Grok 4.2 四十天後的真實心得,從驚人的 200 萬 Token 上下文、361 TPS 的吞吐速度,到四個自定義 Agent 同時協作與圖片影片生成能力,完整剖析 Grok 為何成為他日常使用頻率最高的 AI 工具。

NiceKate AI 實測智譜 AI 開源的 GLM-5.1,在 Joy 平台上從 PDF 生成、PPT 製作、3D 空間建構一路測到交通仿真與影片製作,全面檢驗這款 SWE-Bench Pro 高分模型的真實能力。

Kate 親身實測從 OpenClaw 無痛遷移到 Hermes Agent,從安裝、配置、技能遷移到實戰演示,完整記錄了兩個工具的差異與 Hermes 的獨特優勢。

Keda 實測 Gemma 4 全系列模型(12B/14B/26B/31B),與千問 3.5 系列深度對比,並從零到一打造一款手機上運行的本地 AI 解說 App,涵蓋模型部署、App 開發流程與實戰心得。

GSD 2 將 AI Coding Agent 從提示詞升級為可運維的系統——狀態機驅動、崩潰恢復、預算控制、驗證管線,讓開發者真正可以「跑起來就走開」。