Back to top
  • 공유 分享
  • 인쇄 列印
  • 글자크기 字體大小
已複製網址

Gemini 3.7 Flash傳砍半價,官方文件未列、Pro空窗未解

放著代幣使用量與計算機的開發者辦公桌 / TokenPost.ai

有海外媒體報導指出,Gemini 3.7 Flash將以輸入端每百萬token 0.75美元、輸出端每百萬token 3.75美元的價格,一路提供到2026年底。開發者取向的輕量AI模型價格戰持續延燒,但這項消息與Google(谷歌)官方文件所列出的型號與價格表出現落差。

動區動趨(BlockTempo)於14日報導,Google正式推出Gemini 3.7 Flash,並在年底前提供折扣價。報導指出,新模型聚焦於程式撰寫、代理人(agent)工作流程、除錯、問題修復與商用程式碼生成。

動區動趨報導的規格顯示,新模型支援文字、圖片、音訊、影片輸入,具備100萬token的上下文視窗,最高可輸出6萬4000個token。報導也提到,模型提供可在品質、成本與延遲間調整的「思考設定」。

不過,在Google官方部落格與Google Cloud定價文件中,目前可查到的型號是Gemini 3 Flash、Gemini 3.6 Flash、Gemini 3.5 Flash Lite。Google針對Gemini 3 Flash公布的價格為輸入端每百萬token 0.50美元、輸出端每百萬token 3美元。

Google是否在官方管道另行公布「Gemini 3.7 Flash」這個名稱,以及動區動趨所傳的折扣價格表,目前並未獲得確認。因此這則消息與其說是確定的上市報導,不如視為外媒報導與官方文件之間出現落差、有待釐清的事項。

Flash系列一向以速度快、成本低為賣點,屬於輕量模型陣容。企業與開發者若要把AI模型接入處理大量請求的服務,較低的單價與較短的回應時間,往往比高階模型的效能更關鍵。

Google的Flash產品線近期變動頻繁。Google於7月21日公布了Gemini 3.6 Flash、Gemini 3.5 Flash Lite、Gemini 3.5 Flash Cyber。

Google當時說明,企業與開發者在打造大型AI代理人時,token使用效率、延遲與穩定性都很重要。從這個脈絡來看,Google一方面壓低成本,一方面把商用程式撰寫、資安、代理人執行等需求拆分到不同模型陣容來因應。

對南韓企業而言,AI模型單價是直接影響成本的變數。南韓現代汽車集團在內部生成式AI平台中,讓員工可自行選用ChatGPT、Gemini、Claude等多款外部生成式AI模型來處理業務

模型單價下降,代表同樣預算能處理更多請求。不過實際支出並非只看標價,還會受token使用量、快取機制、批次處理與推論設定影響。

Pro模型遲遲未現身,是另一個值得關注的問題。Google在5月Google I/O相關發表中提到,正在測試Gemini 3.5 Pro,預計隔月提供。

但截至8月5日,一般公開的模型清單上僅列出Gemini 3.6 Flash與Gemini 3.5 Flash Lite,Gemini 3.5 Pro的模型卡尚未公開。本社(TokenPost)先前曾報導,Gemini 3.5 Pro的上市時程比原先預告的還要延後

動區動趨的報導同時提到,有消息指Gemini 3.5 Pro未達內部性能目標,開發者社群也觀察到上市延遲的跡象。必須留意的是,這部分屬於外部報導與社群觀察,並非Google官方說法。

因此,與其把Pro模型的空窗直接解讀成上市取消或效能失敗,更準確的說法是:公開時程目前尚未公布。Flash系列快速迭代、Pro系列進度延後,兩者合在一起,正好呈現出Google目前的AI產品策略走向。

Google的Flash定價策略,可視為鎖定開發者與企業客戶的競爭手段。實際服務成本,以及對包括南韓在內的亞洲企業導入AI所需支出的影響,仍要看Google後續公布的正式價格表與模型釋出時程而定。

查證來源:Google官方部落格、Google Cloud定價文件、動區動趨(BlockTempo)報導。

<版權所有 ⓒ TokenPost,未經授權禁止轉載與散佈>

最受歡迎

其他相關文章

留言 0

留言小技巧

好文章。 希望有後續報導。 分析得很棒。

0/1000

留言小技巧

好文章。 希望有後續報導。 分析得很棒。
1