自主行動與智能成本控制
Google Cloud 執行長庫里安(Thomas Kurian)指出,Gemini Agent 的核心價值在於「給予目標,無需繁瑣指令」。這款單一通用的工作 AI Agent 能自主規劃、使用技能並連結系統,在網頁、行動裝置及電腦上完成工作。特別的是,它會根據任務複雜度自動協調模型:日常瑣事交由輕巧的 Gemini Flash,長期複雜專案則由 Argon 等旗艦模型操刀,甚至整合 Anthropic Claude 模型。這種彈性選擇機制內建成本控制,確保企業在追求效率的同時,也能符合安全、管理及治理規範。
三大核心能力與四種記憶機制
Gemini Agent 的強大來自於工具、技能與情境脈絡三大支柱。它能安全串接 Confluence、Microsoft Teams、Salesforce 及 BigQuery 等現有企業軟體,並透過模組化的「技能」庫重複使用工作流程。在記憶方面,它具備工作階段、語意、程序及情節四種記憶類型,能像隊友一樣記住使用者交代的一切,並維持跨管道的單一脈絡。此外,每個子代理擁有獨立身分(如 @agents.company.com 郵件地址),僅取用相關資訊,確保資料隱私與個人化體驗。
企業市場的新戰場
隨著 Grok Bot、Meta Muse 等競品推動 AI Agent 熱潮,Google 將 Gemini Agent 內建於 Gemini Enterprise 及 Google Workspace,瞄準企業需求擴張。不同於五月推出的消費版 Gemini Spark,企業版強調與現有工作流程的深度整合。透過單一介面交辦任務並直接驗收成果,Gemini Agent 試圖解決企業導入 AI 時的碎片化問題,讓 AI 真正成為具備專屬身分與專業能力的數位同事。