Google 突然拔掉開發者最愛的省錢模型
上週還在用的 Gemini 2.5 Flash,這週直接消失。Google 沒發新聞稿、沒提前通知,就這樣把這顆「窮人救星」從 API 裡撤掉。
這件事為什麼重要?因為 2.5 Flash 是價格殺手——處理 100 萬 token(大概 75 萬字中文)只要 $0.60 美金,約 18 台幣。同樣工作量,2.5 Pro 要 $3 美金,約 90 台幣,差整整 5 倍。
對台灣做 AI 產品的小團隊來說,這不是「升級」,是成本結構被推翻。
為什麼開發者特別愛 2.5 Flash?
你可以把 AI 模型想成計程車:
| 車型 | 特色 | 價格 |
|---|---|---|
| 2.5 Flash | 夠快、夠便宜、日常通勤首選 | 18 台幣/百萬字 |
| 2.5 Pro | 超聰明、但貴,像叫賓士 S-Class 去買宵夜 | 90 台幣/百萬字 |
很多台灣團隊的應用場景其實不需要「最強大腦」——客服回覆、文章摘要、資料整理、自動分類,這些「中學生程度」的工作,Flash 綽綽有餘。
重點是:省下的錢可以養更多用戶。
一個月處理 10 億 token 的產品:
- Flash 時代:約 1,800 台幣
- 現在被迫用 Pro:9,000 台幣
- 一年差額:8 萬多台幣,夠請一位實習生
Google 的官方說法 vs 開發者實際遭遇
Google 的解釋是:「2.5 Pro 已經夠快了,不需要 Flash。」
但開發者在 Reddit 和 X 上炸鍋的點是:
「夠快」跟「夠便宜」是兩件事。我的產品利潤率就 15%,這一刀下去直接轉虧。
更糟的是遷移成本。很多團隊的 Prompt 工程、測試流程、甚至產品架構都是圍繞 Flash 設計的。現在要嘛:
- 硬吞成本,利潤被吃掉
- 降級到 2.0 Flash,但效能差一截
- 整組重寫,換 Claude 或 OpenAI 的模型
沒有一個選項是「無痛」的。
台灣開發者該怎麼應對?
如果你正在用 Gemini API,這三件事現在就要做:
第一步:盤點你的用量
打開 Google Cloud 帳單,看過去 3 個月你燒了多少 token。如果每月超過 5000 萬 token,這波衝擊會很痛。
第二步:測試降級方案
2.0 Flash 還在,雖然笨一點,但價格一樣甜(約 15 台幣/百萬字)。快點跑 A/B 測試,看用戶會不會發現變笨了。
第三步:準備備案
Claude 3.5 Haiku、OpenAI GPT-4o mini 都是同級替代品。重點是不要把雞蛋放同一個籃子,這次教訓夠慘痛了。
這件事給台灣 AI 創業者的啟示
Google 這次操作透露一個訊號:免費/低價的東西,說收就收。
去年 Gemini Pro 還免費,今年開始收費;Flash 本來是「平價替代方案」,現在直接消失。這不是 Google 壞,是大公司的商業邏輯本來就是這樣——先養生態系,再收割。
對台灣小團隊來說,成本結構不能建立在「別人的善心」上。建議:
- 永遠要有 2 家以上的模型備案
- 把 Prompt 設計成「模型無關」,換家不用重寫
- 定期重新談判 API 合約,量大就去談企業價
現在就打開你的 Google Cloud 控制台
確認你的專案還在用哪個模型版本。如果看到 gemini-2.5-flash 開頭的模型名稱,這週內就要決定遷移策略。
別等到 API 回傳 404 才發現產品掛掉。這種「被消失」的劇情,只會越來越常見。