Google 無預警下架 Gemini 2.5 Flash:開發者成本暴增 5 倍

Google 無預警下架 Gemini 2.5 Flash:開發者成本暴增 5 倍

Google 無預警下架 Gemini 2.5 Flash:開發者成本暴增 5 倍

Google 突然拔掉開發者最愛的省錢模型

上週還在用的 Gemini 2.5 Flash,這週直接消失。Google 沒發新聞稿、沒提前通知,就這樣把這顆「窮人救星」從 API 裡撤掉。

這件事為什麼重要?因為 2.5 Flash 是價格殺手——處理 100 萬 token(大概 75 萬字中文)只要 $0.60 美金,約 18 台幣。同樣工作量,2.5 Pro 要 $3 美金,約 90 台幣,差整整 5 倍

對台灣做 AI 產品的小團隊來說,這不是「升級」,是成本結構被推翻


為什麼開發者特別愛 2.5 Flash?

你可以把 AI 模型想成計程車:

車型特色價格
2.5 Flash夠快、夠便宜、日常通勤首選18 台幣/百萬字
2.5 Pro超聰明、但貴,像叫賓士 S-Class 去買宵夜90 台幣/百萬字

很多台灣團隊的應用場景其實不需要「最強大腦」——客服回覆、文章摘要、資料整理、自動分類,這些「中學生程度」的工作,Flash 綽綽有餘。

重點是:省下的錢可以養更多用戶。

一個月處理 10 億 token 的產品:

  • Flash 時代:約 1,800 台幣
  • 現在被迫用 Pro:9,000 台幣
  • 一年差額:8 萬多台幣,夠請一位實習生

Google 的官方說法 vs 開發者實際遭遇

Google 的解釋是:「2.5 Pro 已經夠快了,不需要 Flash。」

但開發者在 Reddit 和 X 上炸鍋的點是:

「夠快」跟「夠便宜」是兩件事。我的產品利潤率就 15%,這一刀下去直接轉虧。

更糟的是遷移成本。很多團隊的 Prompt 工程、測試流程、甚至產品架構都是圍繞 Flash 設計的。現在要嘛:

  1. 硬吞成本,利潤被吃掉
  2. 降級到 2.0 Flash,但效能差一截
  3. 整組重寫,換 Claude 或 OpenAI 的模型

沒有一個選項是「無痛」的。


台灣開發者該怎麼應對?

如果你正在用 Gemini API,這三件事現在就要做:

第一步:盤點你的用量

打開 Google Cloud 帳單,看過去 3 個月你燒了多少 token。如果每月超過 5000 萬 token,這波衝擊會很痛。

第二步:測試降級方案

2.0 Flash 還在,雖然笨一點,但價格一樣甜(約 15 台幣/百萬字)。快點跑 A/B 測試,看用戶會不會發現變笨了。

第三步:準備備案

Claude 3.5 Haiku、OpenAI GPT-4o mini 都是同級替代品。重點是不要把雞蛋放同一個籃子,這次教訓夠慘痛了。


這件事給台灣 AI 創業者的啟示

Google 這次操作透露一個訊號:免費/低價的東西,說收就收

去年 Gemini Pro 還免費,今年開始收費;Flash 本來是「平價替代方案」,現在直接消失。這不是 Google 壞,是大公司的商業邏輯本來就是這樣——先養生態系,再收割。

對台灣小團隊來說,成本結構不能建立在「別人的善心」上。建議:

  • 永遠要有 2 家以上的模型備案
  • 把 Prompt 設計成「模型無關」,換家不用重寫
  • 定期重新談判 API 合約,量大就去談企業價

現在就打開你的 Google Cloud 控制台

確認你的專案還在用哪個模型版本。如果看到 gemini-2.5-flash 開頭的模型名稱,這週內就要決定遷移策略

別等到 API 回傳 404 才發現產品掛掉。這種「被消失」的劇情,只會越來越常見。