Claude 一次就成功!4 大 AI 模型實測:誰最會「一句話生網頁」

Claude 一次就成功!4 大 AI 模型實測:誰最會「一句話生網頁」

Claude 一次就成功!4 大 AI 模型實測:誰最會「一句話生網頁」

一句話叫 AI 寫程式,現在真的可行了

你還記得以前要做個小遊戲或互動網頁,得先學 HTML、CSS、JavaScript,然後 Three.js、Canvas API 全部來一輪嗎?現在不用了。

這週 Grok 4.5 剛推出,xAI 說這是他們「最聰明的模型」,還特別強調跟 Cursor 一起訓練過,專門做程式碼和代理任務。但口說無憑,國外團隊 TryAI 直接做了一場「公證對決」——給四個頂尖模型同一句話,看誰一次就能生出能跑的網頁。

參賽選手:

  • Grok 4.5(xAI 最新款)
  • GPT-5.5(OpenAI 目前最強)
  • Claude Opus 4.8(Anthropic 的旗艦版)
  • Claude Fable 5(Anthropic 的輕量版)

規則很嚴格:只給一句話、不幫忙除錯、不調整 Prompt,生出來的東西直接打開測試。


第一關:3D 魔術方塊(這題超刁鑽)

Prompt 長這樣:

「做一個色彩繽紛、有 3D 感的魔術方塊,要有『打亂』和『解開』按鈕,方塊轉動時要有動畫。」

聽起來簡單?這需要真正的 3D 數學、每個面的狀態管理、還有動畫系統,全部塞進一個 HTML 檔案。

結果揭曉

模型第一次表現最終結果
Claude Opus 4.8✅ 完美顏色正確、會轉、會解
Claude Fable 5✅ 完美跟 Opus 一樣漂亮
Grok 4.5❌ 只出現標題和按鈕,方塊是空白重跑一次後 ✅ 成功
GPT-5.5❌ 只給一個黑黑的方塊顏色全錯,根本不像魔術方塊

Claude 雙雄直接完勝,第一次就生出完整、能玩、有動畫的 3D 魔術方塊。Grok 4.5 第一次大當機,畫面只有按鈕沒有方塊,團隊照規定重跑一次才成功。GPT-5.5 則是徹底翻車,給了一個單色黑方塊就結束了。


第二關:粒子重力沙盒(視覺系大考驗)

Prompt:

「做一個互動式粒子重力沙盒:畫布上有幾百個粒子會留下軌跡,點擊會產生重力吸引點,要讓人看得入迷。」

這題考的是 Canvas 繪圖效能、物理模擬、還有視覺美感。

Claude 雙雄再次領先,生出來的效果像科幻電影——粒子飄動、軌跡殘影、點擊產生漩渦超級療癒。Grok 4.5 和 GPT-5.5 雖然有做出東西,但粒子數量、流暢度、視覺精緻度都明顯差一截。


這對你有什麼用?現在就能試

你不需要懂程式碼,現在打開 Claude 或 Grok,複製這句話:

「做一個單一 HTML 檔案,裡面是【你想要的功能】,要有【某種互動或動畫】。」

實測可行的範例

  • 「做一個番茄鐘,25 分鐘倒數,時間到會響鈴」
  • 「做一個記帳小工具,可以輸入金額和分類,顯示今日總計」
  • 「做一個抽籤程式,輸入名字後會隨機選一個,有轉動動畫」

AI 會吐給你一段程式碼,直接存成 .html 檔,用瀏覽器打開就能用


小提醒:這些事 AI 還不太行

雖然很強,但別太天真:

  • 複雜邏輯會出錯:需要多步驟判斷的遊戲規則,AI 常漏掉細節
  • 手機相容性:生出來的東西在電腦瀏覽器 OK,手機可能跑版
  • 不能存資料:關掉網頁資料就消失,要接資料庫還是得找人幫忙

但對「快速驗證想法」「做個小工具給自己用」「學生交互動網頁作業」這些場景,已經超級夠用。


結論:Claude 目前最穩,但每家都能玩

這次實測,Claude Opus 4.8 和 Fable 5 是唯二兩題都一次成功的,穩定度明顯領先。Grok 4.5 雖然要重跑,但最終品質不錯。GPT-5.5 在視覺和 3D 任務上明顯落後。

不過重點是——你現在就有這些工具,不需要等、不需要付費課程,打開瀏覽器就能開始。

下次需要做個小工具、做個互動網頁交作業、或單純想試試「我一句話能叫 AI 做出什麼」,就直接把這篇的 Prompt 複製貼上吧。

現在就打開 Claude 或 Grok,輸入「做一個______」,看看它會給你什麼驚喜。