← 返回 Blog

Gemini 3.6 Flash 發布:更便宜的主力模型,香港即日可用

Gemini 3.6 Flash 發布:更便宜的主力模型,香港即日可用

這次 Google 發新模型,大家最等的那款反而繼續缺席。

7 月 21 日(美國時間),Google 一口氣發布三款模型:新一代主力 Gemini 3.6 Flash、走最低價路線的 Gemini 3.5 Flash-Lite,以及專門為找漏洞、修漏洞而調校的 Gemini 3.5 Flash Cyber。至於 5 月 Google I/O 亮相至今的旗艦 Gemini 3.5 Pro,官方只說「很快會全面開放」,正式上市仍然無期。

3.6 Flash 升級了什麼

Flash 是 Gemini 家族的「工作馬」檔:不是最聰明,但夠快、夠便宜,為日常大量使用而設。好比茶餐廳的常餐與招牌大菜——招牌菜偶然吃一次,常餐才是一日三餐的主角。大部分人的大部分 AI 用量,其實都落在這一檔。

這次升級的實際內容,三個數字:

  • 輸出定價由每百萬 token 9 美元降至 7.5 美元,便宜約 17%;

  • 在 Artificial Analysis 指數上,完成同樣工作的輸出 token 用量比上代少 17%(編程基準 DeepSWE 最多少 65%);

  • 兩者疊加,同類任務的實際輸出成本最多可低約三成——減價之餘,它還更省 token。

能力不跌反升:DeepSWE 得分由 37% 升至 49%。可用性方面,3.6 Flash 即日進駐 Gemini app,全員可用;開發者可經 Google AI Studio 與 Android Studio 接入 API。

冷靜看:旗艦遲到,工作馬先行

值得留意的不是單一模型,而是節奏。7 月以來,GPT-5.6 家族主打入場價,Kimi K3 直接開源免費(我們在《從第 18 到第 1:開源 Kimi K3 壓過付費旗艦,然後呢》拆解過),如今 Gemini 3.6 Flash 減價登場——大廠的主戰場,已由「誰最聰明」移到「誰夠用又便宜」。旗艦仍在路上(Google 稱 Gemini 4 已開始 pre-training),但當下鬥得最兇的是中價檔,因為走量的正是這一檔。

對用戶,這是實實在在的紅利:同一份工作,成本一個月比一個月低。需要提防的只有「最多」兩個字——省 17% 是指數上的平均表現,65% 是個別測試的上限,你手上任務實際能省多少,要自己跑過才算數。官方數字供參考,判準永遠是你的任務。

對香港與中國用戶的實際意義

香港用戶這次直接受惠。Gemini 是少數官方支援香港的頂級 AI(2026 年 3 月起正式可用),3.6 Flash 已在 Gemini app 上線——無需任何設定,打開就是新模型,免費檔已夠日常使用。官方渠道能直接用的,我們一向建議直接用。

中國用戶是另一幅風景:Gemini 官方仍不支援中國;Claude、GPT 系列同樣不開放。網絡以外,還有支付與封號兩座山。需要頂級模型的現實做法,是經穩定直連網關按用量使用官方模型——萃靈 Essevin 做的正是這件事:一個帳戶用多個頂級模型,中國用戶支付寶、微信支付即可增值,香港用戶轉數快、PayMe 同樣通行,用多少付多少。

收尾

三個月前,「便宜檔」還帶點「將就用」的意味;現在它是大廠鬥得最兇的戰場。與其等一個遲遲不來的旗艦,不如把工作按任務分檔:日常走量用 Flash 這類工作馬,難題才出動頂級模型。錢花在刀口上,這一波價格戰才算真正落到你口袋。


*本文資料截至發稿日(2026 年 7 月 22 日),僅供一般參考,不構成任何建議;第三方產品之功能、價格與政策,以其官方最新公布為準;Essevin 服務詳情以官網與 console 實際顯示為準。