Gemini 4好用嗎?谷歌新AI模型開放時程、功能亮點、爭議一次看

  • 編譯:廖國安
  • 發佈時間:2026.10.01 11:19
  • 最後更新時間:2026.10.01 11:19
將網站加入你的 Google 偏好搜尋來源,更容易搜尋到喜歡的內容
Google新一代旗艦AI模型Gemini 4 Argon,即將推出。(圖/Shutterstock達志影像)

Google新一代旗艦AI模型Gemini 4 Argon,即將推出。(圖/Shutterstock達志影像)

Google新一代旗艦AI模型「Gemini 4 Argon」開始向部分合作夥伴開放,主打軟體工程、金融、法律與資安等複雜任務。不過,根據《彭博社》今(1日)報導,Google內部對新模型的實際表現仍有分歧:部分員工認為,Gemini 4雖然在評測中拿下高分,處理真實程式開發工作時卻不夠穩定,尤其前端設計能力受到質疑。Google否認模型在程式設計等領域表現不佳。Gemini 4有哪些功能?何時能使用?以下整理報導重點。

Gemini 4是什麼?Argon代表什麼?

Gemini 4 Argon是Google新一代旗艦人工智慧模型,延續Gemini系列,目標是處理時間更長、步驟更多的專業工作。根據Google說法,新模型適用於軟體工程、金融、法律與網路安全等領域。除了文字處理,Gemini 4也具備理解其他形式輸入的能力,例如分析影片、擷取中繼資料。

Gemini 4何時開放?一般用戶可以用了嗎?

Google於美國時間9月30日,先向一小群可信任的資安合作夥伴開放Gemini 4,並表示會在完成更多測試後擴大使用範圍,優先從付費訂閱者開始。

Gemini 4有哪些功能亮點?

根據Google說法及《彭博》引述的知情人士資訊,Gemini 4的主要亮點包括:複雜專業任務:主打軟體工程、金融、法律與資安工作。多模態理解:知情人士稱,分析非文字輸入、擷取影片中繼資料的表現突出。資安能力:Google稱,模型在一項安全技能評測中超越OpenAI的Astra。自然溝通:知情人士肯定其表達清楚、自然的能力。長篇輸出:Google稱,單次最多可產生100萬個token

Gemini 4寫程式好用嗎?為何Google員工有疑慮?

《彭博》引述直接接觸模型開發與內部評估的人士指出,Gemini 4的程式能力並不均衡,部分評測成績亮眼,但員工實際拿來工作時,表現未必同樣出色。

其中一項被點名的弱點是「前端設計」,也就是網站或App的介面、視覺呈現與操作體驗。對AI程式工具而言,能寫出程式碼只是其中一步,還要能把功能整合成好用的產品。

Google否認Gemini 4在程式設計等領域表現不佳。另一名熟悉模型開發的員工則向《彭博》表示,公司內部普遍認為Gemini 4已達到最先進模型水準,也已接受嚴格測試。

Gemini 4比OpenAI、Anthropic強嗎?

Google表示,Gemini 4在多項基準測試中取得領先分數,其中一項資安技能評測超越OpenAI的Astra。但部分Google員工認為,OpenAI的Astra與Anthropic的Fable進步速度更快,Gemini 4即使發揮最佳表現,在某些領域仍可能落後;另一些員工則認為,新模型已追上競爭對手。

「Benchmaxxing」是什麼?AI高分為何不一定好用?

報導提到,AI產業存在被稱為「benchmaxxing」的現象,意指開發團隊過度追求基準測試高分,卻未必同步改善真實使用體驗。AI新創Surge AI創辦人陳瀚生(Edwin Chen)指出,若實驗室太依賴評測,可能會把重心放在特定程式語言的答題能力,而非打造容易操作、設計良好的應用程式。

這也解釋了為何AI模型可能「考試很強」,實際完成複雜工作時卻仍遇到困難。不過,Gemini 4是否存在這項問題,目前是知情人士提出的質疑,Google並未認同模型實務能力不足的說法。

文章引用

延伸閱讀