
NiceKate AI:实测 Qwen3.6-Max-Preview vs Claude Opus 4.7,编码有惊喜
凱特實測 Qwen3.6-Max-Preview 與 Claude Opus 4.7,從冰馬勇接舞、復古相機模擬器、書法平台到縴夫拉船共六個場景全面對比。3.6-Max Preview 生成速度快、創意足,但 Opus 4.7 在細節與精緻度上仍略勝一籌。
開場閒聊
凱特一開場就笑說,今天這支影片本來不在計畫內,但下午看到千問 3.6 Max Preview 推出後簡單體驗了一下,發現效果讓她非常驚喜。
她回憶上次介紹千問 3.6 Plus 的時候,模型剛上線,在千問 Chat 裡面速度很慢,還有各種 bug。但這次 3.6 Max Preview 一上線,整個流程順暢很多,速度也非常快。她忍不住就把多個場景拿出來跟 Claude Opus 4.7 做了個對比,於是就有了這支影片。
凱特這次实测 Qwen3.6-Max-Preview,從冰馬勇接舞到復古相機、書法平台再到縴夫拉船,總共六個場景,全面驗證了模型在編碼方面的真實實力。
整體而言,编码方面确实有惊喜——3.6-Max Preview 在創意方向和生成速度上的表現,遠超凱特的預期。
凱特還透露了一個小細節:官方說這次 Max 對比 Plus 帶來了更強的世界知識和指令遵從能力,編程能力更是明顯提升。從官方 Benchmark 來看,SuperGPQA 科學問題方面 Max 得分非常高;TerminalBench 2.0 也明顯領先 GLM-5.1;唯獨 SWE-Bench Pro 略低 GLM-5.1 一些。
懶人包速覽
| 核心痛點 | 解決方案 / 關鍵觀點 |
|---|---|
| 千問新模型升級了什麼? | Qwen3.6-Max-Preview 相比 Plus 版本,世界知識、指令遵從、編碼能力全面提升,API 即將開放 |
| 3.6-Max 跟 Opus 4.7 差多少? | 生成速度快(2-3 分鐘 vs Grok 20 分鐘),創意方向好,但精緻度和細節仍不及 Opus 4.7 |
| 適合編碼場景嗎? | 參數量大、基礎好,編碼輔助力強,Demo 生成效果明顯優於前代 |
| 實戰值得用嗎? | 性價比高、速度快,適合快速原型和 idea 驗證,精緻場景仍建議 Opus 4.7 |
凱特這次準備了六個完全不同的測試場景,從動畫互動、影像模擬、書法創作到 3D 場景建構,全面考驗兩個模型的理解與程式生成能力。以下是她實際測試的完整紀錄。
冰馬勇接舞:動態互動的對決
第一個測試是讓兩個模型做「冰馬勇接舞」——點擊畫面就可以切換五種不同的舞蹈動作。
3.6-Max Preview 的表現讓凱特非常開心。她說以前測試過多個模型,千問 3 系列在這個問題上做得相對一般,但 3.6 Max Preview 就好很多。五個冰馬勇各有絕活——有的跳 breaking,有的頭部扭轉特別厲害,還有的做機器人舞蹈,中間的 DJ 和燈光效果都不錯。
Claude Opus 4.7 生成的版本也非常有意思。凱特觀察到 Opus 4.7 在總結時提到冰馬勇的髮型參考了真實冰馬勇,而且五個角色的動作設計更豐富。整體來看,凱特認為 Opus 4.7 更勝一籌。
復古膠片相機模擬器:功能完整性測試
第二個場景是復古膠片相機模擬器,用戶可以上傳圖片,選擇不同相機的感覺,右側還有參數調整(曝光程度、滑痕數量、按角大小、顆粒強度)。
3.6-Max 做出的頁面非常美觀。點擊拍攝按鈕有動效,也可以導出圖片。但凱特發現一個問題:即使在設定中把滑痕數量調到最大,導出後的圖片還是沒有足夠的滑痕效果——功能細節上仍有改進空間。
書法數字平台:創意與細節的較量
這是最令凱特印象深刻的測試。3.6-Max 生成的書法平台,鼠標移動時整個指標都是毛筆狀態。她當場寫了一個「大」字,左側圖標下方的文字全部是 Max 自己想的——「禪」「魔」用一個字就概括得非常精準,返回按鈕用「回」字也非常到位。
紋樣設計方面,龜背紋、祥雲等傳統元素搭配得很好。凱特提到左側還有「艷」和「喜」兩個按鈕——點擊「艷」顏色變濃,點擊「喜」顏色變淡。總體而言,她對生成效果非常滿意。
再看 Opus 4.7 的版本,界面同樣做得非常好。右側有不同紋理,紋理下方還加了說明文字。點擊祥雲可以放大放在不同位置。Opus 4.7 對文字的理解非常好,比如「禁止」「裝裱導出」非常適合場景。右側還有臨摹按鈕——點擊出現一條龍,用戶可以根據它來臨摹。
不過凱特也發現,Opus 4.7 在墨跡效果上不如 3.6-Max 穩定——下墨後突然變淡又漸漸有顏色,吸筆效果也還有改善空間。
禮物包裝智能助手:速度 vs 品質
讓兩個模型做一個禮物包裝智能助手——輸入尺寸、選擇禮物形狀、設定是否環保模式,然後點擊生成包裝方案。
3.6-Max 做的維度很多,花紋也多,但凱特發現波點圖案點進去跟左邊預覽有出入,包裝最後一個狀態也有錯位。不過下方的包裝紙裁剪展開圖倒是做得不錯。
凱特還順便對比了 Grok 4.3 beta。Grok 花了 20 分鐘 才生成,而 3.6-Max 只用了 2-3 分鐘。Grok 的 3D 效果確實不錯——可以切換圓柱體、選擇不同絲帶和包裝紙,但速度實在太慢了。
至於 Opus 4.7,凱特在前幾天的影片已經介紹過,生成的頁面效果絕對秒殺前兩個模型。
縴夫拉船場景:3D 場景建構力
這個測試讓凱特特別滿意。她給 3.6-Max 的提示非常簡單——使用 Three.js 構建精細的縴夫拉船場景。
3.6-Max 生成的副標題寫的是「川江號子,逆水行舟」,這個副標題加得非常到位。場景中包含了纜繩、縴夫(還戴著帽子防止曬傷),甚至懶繩都展現出來了。背景設定在逆水行舟的河邊,有綠植和高山。
凱特特別指出,之前測試的一些模型會漏掉懶繩,但 3.6-Max 沒有遺漏,雖然船上的夾板和船身還有比較大的問題,但整體完成度令人驚喜。
Opus 4.7 的版本同樣優秀——縴夫頭上都戴了帽子,腿在走動,每一個縴夫都有一條繩子與船綁定。比較遺憾的是船和繩子中間缺了一段。上方的旗子隨風飄揚,整體非常流暢,船的造型也非常好。
其他場景:像素時鐘與馬卡龍花園
凱特還用 3.6-Max 做了星空谷物語像素時鐘——上方顯示目前時間、右側有日期、下方有農場、稻草人、房屋,屋頂還有炊煙裊裊。因為 3.6-Max 目前不支援圖片識別,凱特在提示時沒有用到圖片參考,能一次性生成這樣的結果已經非常不錯了。
最後做馬卡龍花園時,3.6-Max 的版本有不同主題,蝴蝶數量可以調整,但看不出蝴蝶和花在哪裡。相比之下,Claude Design 透過 Opus 4.7 生成的馬卡龍花園,花明顯好看很多,還可以切換不同色系,蝴蝶造型也在展示飛翔。
QA 精選
Q1:Qwen3.6-Max-Preview 最重要的升級是什麼?
根據官方說法,Max 對比 Plus 帶來了更強的世界知識和指令遵從能力,編程能力更是大幅提升。從 Benchmark 數據來看,SuperGPQA(科學問題)得分非常高,TerminalBench 2.0 也優於 GLM-5.1。不過 SWE-Bench Pro 得分略低 GLM-5.1。
Q2:3.6-Max 跟 Claude Opus 4.7 比,誰更強?
這取決於使用場景。3.6-Max 的優勢在於生成速度快(多數場景 2-3 分鐘),創意方向好,對中文理解和傳統元素表現出色——比如書法平台的「禪」「魔」用字和龜背紋設計。Opus 4.7 則在細節、精緻度和 UI 一致性上更勝一籌——冰馬勇的動作設計、禮物包裝的完整度都明顯更好。
Q3:為什麼 Grok 4.3 beta 生成花了 20 分鐘?
凱特在對比中特別指出,Grok 4.3 beta 版本的生成速度非常慢,同樣的禮物包裝場景,3.6-Max 只花 2-3 分鐘,而 Grok 需要 20 分鐘。
雖然 Grok 的 3D 效果不錯——可以切換圓柱體、選擇絲帶和包裝紙,但速度差距讓它實戰價值大打折扣。
Q4:Qwen3.6-Max-Preview 目前有什麼限制?
目前 3.6-Max Preview 還不支援圖片識別,因此無法透過上傳圖片來引導模型生成特定視覺效果。凱特在做像素時鐘時只能靠文字描述來引導。此外,部分場景存在細節問題——相機模擬器的滑痕效果導出後不明顯、禮物包裝的花紋有錯位、船身與夾板的結構有待改善。
Q5:這波 AI 模型進步的速度有多快?
凱特在影片尾聲提到一個重要觀察:同樣的測試題,她半年前測過多個模型,當時的表現遠不如現在。她明顯感覺到現在的模型對比半年前進步非常多。從 3.6 Plus 到 3.6 Max Preview 的迭代速度,以及過去半年各模型的進步幅度,驗證了 AI 編碼能力的快速增長趨勢。
主編隨筆
凱特從六個完全不同類型的場景來測試兩個模型,這個對比方式本身就很值得參考。一般模型評測只跑 Benchmark 分數,但實際使用體驗與 Benchmark 經常存在差距——3.6-Max Preview 的 SWE-Bench Pro 分數低於 GLM-5.1,但實測表現卻相當亮眼,尤其在創意方向的拿捏上。
我觀察到一個有趣的模式:3.6-Max 在「快思維」類的任務上表現突出——書法平台的文字選擇(禪、魔、回)顯示模型對文化語境有相當深入的理解,這不是單純的參數量能解釋的,更像是訓練資料中高品質中文內容的體現。相較之下,Opus 4.7 的優勢在於「慢思維」——細節打磨、UI 一致性、動畫流暢度,這些都需要更深的推理能力。
對於開發者來說,我認為兩者並非競爭關係,而是互補。3.6-Max Preview 適合快速原型驗證——想一個 idea、幾分鐘看到雛型,迭代速度極快。而需要上線品質的場景,Opus 4.7 依然是目前的首選。這個分層策略可以大幅提升開發效率。
結語
Qwen3.6-Max-Preview 的表現確實讓人驚喜。生成速度極快、創意豐富、中文語境理解到位,雖然在精緻度上還不及 Claude Opus 4.7,但考慮到其速度優勢和即將開放的 API,對於需要快速迭代的開發場景來說是一個非常有競爭力的選擇。
凱特的實測也再次證明了一件事:2026 年的 AI 模型正在以前所未有的速度進步,半年時間就能看到跨越式的提升。
如果你正在考慮將哪個模型導入開發流程,3.6-Max Preview 作為快速原型工具、Opus 4.7 作為精細打磨工具,這個雙軌策略目前看來是最有效率的搭配。
首先生成速度快、编码有惊喜——3.6-Max Preview 在六個場景實測中的表現,證明了它已經是一個非常成熟的生產力工具。7,编码有惊喜是凱特對這次測試的最大感受。
本文章僅作為學習與交流用途,不構成任何投資建議。 原始內容版權歸原節目製作人所有。本網站內容經 AI 輔助整理,並經人工審核後發布,可能仍包含錯誤。 詳見 版權聲明與免責條款。









