你的手機 AI 馬上要變聰明 10 倍
還記得現在 Siri 那種「請稍等我連上網路」的尷尬嗎?一家叫 PrismML 的新創公司剛丟出一個大消息:他們把 270 億參數的大型語言模型 Qwen3.6-27B 壓縮到能在 iPhone 17 Pro 本機跑,而且 Apple 已經找他們開過會了。
這不是什麼實驗室 Demo,是實打實能用的東西。更猛的是,他們用的不是新硬體,是純軟體壓縮技術。
為什麼這件事很重要?先懂「參數」是什麼
你可以把 AI 模型想成一本超厚的字典,參數就是裡面的詞條數量。詞條越多,AI 越聰明、越會理解複雜的問題。
- Google Gemini Nano(目前手機常見):約 32 億參數
- Apple AFM 3 Core Advanced(今年 6 月剛發):200 億參數,但要用「稀疏架構」取巧,只啟動其中 10~40 億
- PrismML 這次做到的:270 億參數,全部塞進手機
差距大概是「小六學生 vs. 台大畢業生」的等級。
他們怎麼做到的?把數字砍到極限
一般 AI 模型每個參數用 16 位元(很精細的數字)儲存,PrismML 開發了兩種壓縮術:
| 技術名稱 | 怎麼壓 | 效果 |
|---|---|---|
| 1-bit Bonsai | 每個參數只存 0 或 1 | 記憶體省到 1/14,速度快 8 倍,耗電 1/5 |
| Ternary Bonsai | 每個參數存 -1、0、1 三種 | 稍微多一點空間,但準確度更高 |
簡單說:就像把 1080p 影片壓成 480p,畫面還能看,但檔案小到離譜。
Apple 為什麼急著找他們?
Apple 從 2024 年開始就一直強調「端側 AI」(On-Device AI)——讓 AI 在你手機裡跑,不用連雲端。好處很明顯:
- 沒網路也能用:搭高鐵過隧道、去山上露營,AI 照樣工作
- 隱私更安全:你的對話、文件、照片不用上傳到別人的伺服器
- 反應更快:不用等網路來回,點下去馬上有回應
但問題一直是:夠聰明的模型太大,手機塞不下。PrismML 的技術剛好解決這個死結。
根據 The Information 報導,Apple 已經和 PrismML 開過會,討論怎麼把這套壓縮技術用在 iPhone 上。
這對台灣人實際有什麼影響?
想像幾個場景:
通勤時改履歷 → 高鐵上沒訊號,AI 照樣幫你潤稿、抓錯字,不用等進站
報稅季問問題 → 把所得稅資料丟給 AI 分析,資料完全留在手機,不用擔心外洩
長輩問醫療問題 → 病症描述、用藥紀錄給 AI 整理,不用擔心健保資料被蒐集
學生準備學測 → 離線也能問數學題、要解題步驟,圖書館沒網路照樣用
這些現在要依賴 ChatGPT、Claude 雲端服務的事,未來可能變成手機內建功能,而且完全離線。
什麼時候會發生?
PrismML 已經在 iPhone 17 Pro 上跑通 Qwen3.6-27B,但 Apple 會不會採用、什麼時候採用,還沒有官方說法。
可以觀察的時間點:
- 2025 年 9 月:iPhone 17 系列上市,看有沒有相關功能
- WWDC 2026:Apple 通常會在這時公布新的 AI 架構
- iOS 18/19 更新:軟體端側 AI 可能透過系統更新推送
現在可以試什麼?
雖然 PrismML 的技術還沒開放一般用戶,但你可以先體驗「端側 AI」的概念:
- iPhone 用戶:升級到 iOS 18,試試「Apple Intelligence」的本地功能(目前限英文)
- Android 用戶:Google Pixel 8/9 系列的 Gemini Nano 已經有部分離線功能
- 想玩壓縮模型:Hugging Face 上有一些開源的量化模型可以下載試跑
真正的改變不是「AI 變得更強」,而是「強大的 AI 終於可以只屬於你」。
試試看吧——打開手機設定,看看你的 AI 功能現在是「連雲端」還是「本地端」,這個差別,可能就是未來一年的科技主戰場。