科技巨頭Google今(19)日正式推出最新一代大語言模型「Gemini 3」,這是繼去年底 Gemini 1及今年初Gemini 2之後的第3代旗艦AI模型。Google高層指出,Gemini 3的推出標誌著AI從單純「讀懂文字」進化到能「讀懂情境與意圖」,在多模態理解、推理能力與代理式操作上全面超越前代產品。
AI不再只懂文字 更能洞悉使用者意圖
Google母公司Alphabet執行長皮查伊(Sundar Pichai)表示,Gemini系列已累積每月超過6.5億名活躍用戶,並吸引1300萬名開發者利用Gemini進行開發。皮查伊強調,Gemini 3不只升級參數與速度,更是AI從被動回答使用者邁向主動理解使用者的關鍵。Google旗下研究公司DeepMind執行長哈薩比斯(Demis Hassabis)亦指出,Gemini 3是全球多模態理解能力最強、代理能力最完整的模型。
Gemini 3在AI模型測驗平台LMArena測試中取得1501分,超越Gemini 2.5Pro的1451分;在測試化學、物理和生物學專業知識的GPQA Diamond測試中表現得分91.9%,Humanity’s Last Exam則得分37%,展現了博士級的推理能力。啟用「Deep Think」模式後分別提升至93.8%與41%,展現其解決複雜問題的能力。多模態處理方面,Gemini 3可同時理解文字、圖片、影片、音訊與程式碼,應用於教育、程式開發及日常生活場景。
代理式AI再升級 實現互動式開發
在代理式AI與程式開發上,Gemini 3在WebDev Arena排行榜以1487 ELO奪冠,SWE-bench Verified測試取得76.2%,並搭配新推出的Google Antigravity平台,讓AI能主動操作編輯器、瀏覽器與終端機,實現協作開發。日常應用方面,Gemini 3可將手寫食譜整理成電子書、分析運動影片提出訓練建議,搜尋中的AI模式也即日起更新至Gemini 3,提供互動視覺化介面。
◤音樂劇魔女宅急便◢
◤你的早餐吃對了嗎?◢






