AI戰局再度升溫。隨著Google於11月推出全新模型Gemini 3、OpenAI上週發表GPT-5.2,全球AI雙雄的競爭焦點,已明顯從「算力軍備競賽」轉向路線之爭。一邊是Google押寶生態系整合,力拚讓AI無所不在;另一邊則是OpenAI強打準確度與可靠性,直攻企業最在意的「幻覺」問題。
Gemini 3不只會聊天 進化成能「動手做事」的AI代理人
Gemini 3最大突破,在於從單純對話工具,進化為可主動執行任務的「代理人」(Agent)。透過與Android系統及Workspace雲端辦公平台深度整合,使用者不必再複製貼上資料,AI就能直接讀取行事曆、郵件與地圖資訊,自行完成多步驟操作。
例如,只需一句「幫我規劃下週去首爾的行程並訂房」,Gemini 3便能同步比對機票價格、查詢飯店空房,甚至直接在第三方App完成預訂,徹底改變人機互動方式。
混合專家架構撐起高互動 AI不再單打獨鬥
為支援高頻率、多任務的使用情境,Gemini 3採用「混合專家」(Mixture of Experts)模型架構,系統可依輸入內容,動態調用最適合處理語言或影像的專家模型。
這也象徵頂級AI模型的設計思維轉向:不再追求單一模型全能,而是讓不同專家組隊合作,打出「團體戰」。
Google暨Alphabet執行長皮查伊(Sundar Pichai)近期受訪時直言,Gemini 3正具體落實Google的「AI優先」策略,已全面滲透搜尋、YouTube、雲端服務,甚至Waymo自動駕駛。
OpenAI反其道而行 把準確度當成主戰場
相較Google主打廣度,OpenAI則選擇深度突圍。最新推出的GPT-5.2,在邏輯推理、程式撰寫與醫療文獻分析等高風險應用場景中,展現更高準確度。
OpenAI指出,GPT-5.2 Thinking版本的「幻覺」比例,較前一代GPT-5.1 Thinking降低38%,代表模型在知識工作上的可靠性大幅提升,正面回應企業長期對AI錯誤風險的疑慮。
三版本策略 對準不同使用族群
GPT-5.2並非單一模型,而是分為三種定位:
- GPT-5.2 Thinking:專業級推理模型,主打高準確度與低錯誤率
- GPT-5.2 Instant:偏向日常工作與學習,回應更快,適合查詢、寫作與翻譯
- GPT-5.2 Pro:容許較長回應時間,專攻高難度問題,在程式設計等複雜任務表現更佳
此一分眾策略,也顯示OpenAI正積極搶攻企業與專業市場。
阿特曼:10年內,人類將能做出難以想像的事
在GPT-5.2發表之際,OpenAI執行長阿特曼(Sam Altman)於官網發表〈10年〉一文,回顧公司成立以來的歷程。他坦言,GPT-4問世後,AGI不再只是空想,過去3年更是承受巨大壓力與責任,AI正以前所未有的速度融入世界。
阿特曼直言:「再過10年,我幾乎可以肯定,我們能建立超級智慧。」他認為,2035年的人類,將能完成許多現今難以想像的事情。
專家觀點:OpenAI的考驗才正要開始
(相關報導: OpenAI加速推出GPT-5.2!最快下周亮相 全面回擊Google Gemini 3 | 更多文章 )
專精AI的iKala共同創辦人暨執行長程世嘉分析,OpenAI目前明確鎖定企業用戶,但在資本市場環境轉趨保守下,投資人更在意的是實際獲利能力,「這將是OpenAI接下來必須面對的資源拉扯。」












































