Google 於近期正式推出新一代旗艦模型 Gemini 4 Argon,宣佈在邏輯推理與程式開發能力上重新躋身業界第一梯隊。這款大型語言模型(LLM)不僅展現出高效率的軟體重構與多模態解析能力,更挾帶強大的資金實力祭出低至對手兩成的定價策略搶佔市場。
跳過中間版本直攻 Gemini 4,寫程式與資料分析能力大幅躍升
在研發過程中,Google 曾規劃推出過渡性質的 Gemini 3.5,但因面臨團隊組織調整、時程延宕以及程式寫作效能不足等挑戰,最終決定終止該版本開發,直接加速推出 Gemini 4 Argon。新模型在綜合邏輯運算上已可媲美 OpenAI 的 Astra 與 Anthropic 的 Fable 5.1,且幻覺現象(即模型生成錯誤答案卻給予肯定敘述的情況)發生率為同級產品中最低。
在實際應用端,Argon 展現了顯著的企業級價值。針對極度耗費人力的程式碼翻新任務,Argon 能自動完成舊版語言轉化與效能測試,運作速度較過往提升約 2.7 倍。在衡量實務軟體工程表現的 DeepSWE v1.1 評測中,該模型以 77.9% 的高分刷新業界紀錄。此外,在 Google 內部的資料中心架構優化上,該技術亦成功為基礎設施節省了上千 TB 的記憶體資源。
Argon 單次運算最多可輸出高達 100 萬字,並具備優異的圖文與影片解析能力。無論是解讀複雜的財務報表圖表、進行稅務分析或審閱法律合約,均能在專業測試中取得極佳表現。不過,在純粹事實準確度的測試項目中,Argon 的 50% 表現仍低於對手 Astra 的 63%,且部分 Google 員工指出,其在實際撰寫程式時的感受與評測高分仍有落差。
聚焦主動資安防禦,採分階段開放機制
資安防禦是這次 Gemini 4 Argon 的重點創新之一。雲端資安業者 Wiz 在早期測試中將未設置安全限制的模型導入防護體系,成功發現了一項恐釀成全球醫療院所使用者隱私洩漏的嚴重資安風險,展現出傳統工具或其他先進模型過去未能識別的防禦能力。
為了確保技術安全性並防止潛在濫用,Google 規劃了嚴格的分階段開放流程。目前的首波階段僅限特定的網路安全合作夥伴,以及參與美國政府自願審查計畫的機構進行內部測試。未來第二階段才會逐步開放給應用程式介面(API)的付費企業客戶,以及 Google AI Ultra 的個人訂閱方案使用者。
價格戰再升級,早鳥價下殺對手兩成
除了技術升級之外,Google 亦憑藉內部軟硬體整合與龐大的現金流優勢,對競爭對手發動震撼性的價格戰。在早鳥優惠期間,Argon 每處理一百萬個輸入詞元(Token)僅收費 2 美元,輸出同等數量詞元的費用則是 10 美元;即便恢復原價(分別為 4 美元與 20 美元),仍僅為 OpenAI Astra 與 Anthropic Fable 5.1 等同級模型(輸入 10 美元、輸出 50 美元)的四成價格。
此外,針對需要針對同一批龐大文字或數據進行多次查詢與分析的企業客戶,Google 還推出了快取優化機制,可將重複讀取資料的輸入費用再降低高達 95%,顯著拉低企業部署生成式 AI 的成本門檻。
這代表什麼
對台灣的中小企業與資訊服務業者而言,Google 這次發布的 Gemini AI 策略具有極高的務實意義。過去許多企業在評估引進生成式 AI 進行老舊系統重構、合約審查或客服資料檢索時,常因為動輒數十萬元的 API 算力費用而退避三舍。隨著旗艦級模型價格大幅下滑至原先的兩成,企業將能以更低的預算處理龐大的企業專屬資料。
另一方面,AI 市場競爭已從純粹的比拚模型參數與理論「智商」,轉變為價格、實際執行效率與資安防護的全面對決。軟體團隊在開發自動化工具時,將享有更高的成本彈性,進而帶動各行各業加速內部數位轉型與流程自動化的普及率。
背景補充
在生成式 AI 領域中,「第一梯隊」通常指具備頂尖邏輯推理與跨模態處理能力的旗艦模型,主要競爭者包括開發 ChatGPT 的 OpenAI、獲得亞馬遜投資的 Anthropic,以及掌握基礎架構的 Google。大型語言模型在計費時多以「詞元(Token)」為單位,一個詞元大約代表半個英文單字或一個中文字,費用通常區分為提供資料給模型的「輸入」與模型生成回應的「輸出」。
此外,企業在導入 AI 時最常面臨的挑戰之一是「幻覺(Hallucination)」,即模型生成看似合理但完全不符合事實的內容。而「快取(Context Caching)」則是一種降低運算的技術,讓模型在重複閱讀同一份資料時不必重新計算,從而大幅降低收費。
常見問題
Gemini 4 Argon 的定價策略對企業有哪些優惠?
早鳥價輸入與輸出詞元僅需同級對手兩成價格,若企業需要重複讀取相同的龐大資料集,輸入費用最高還能額外享有 95% 的折抵。
Gemini 4 Argon 在軟體開發上有哪些具體表現?
該模型在 DeepSWE v1.1 評測取得 77.9% 的分數,且改寫老舊程式碼與執行測試的速度比過往快 2.7 倍。
目前一般使用者可以立刻體驗 Gemini 4 Argon 嗎?
目前採取分階段開放,首波僅提供給特定資安夥伴與美國政府機構審查,隨後才會開放給 API 付費客戶與 Google AI Ultra 訂閱者。