日前,谷歌云宣布推出面向企业场景的通用智能体Gemini Agent,可通过单一界面处理问答、资料整理、内容创作、数据分析及代码编写和运行等任务。此外,该智能体能够根据用户设定的目标调用企业内部工具和数据,并通过多个子智能体协同完成复杂工作。

具体功能上,Gemini Agent可通过Gmail、Drive、Docs、Sheets、Slides、Chat和Calendar等Google Workspace应用,完成跨应用任务。例如,用户要求制作市场分析报告,它可以自行搜索和整理资料、分析数据、在Google Sheets中建立财务模型,并调用Google Slides生成演示文稿。
据悉,Gemini Agent还支持长期运行任务,并通过会话记忆、语义记忆、程序性记忆和情景记忆保留任务进度、业务知识及工作流程,以便后续继续执行相关工作。
此外,谷歌方面还推出Coworker Agent(同事智能体),企业可以为其配置独立Google Workspace账号、企业邮箱、日历和Google Drive存储空间,使其参与团队日常协作。创建完成后,企业员工可以通过Google Chat邀请其加入群聊,或是在文档中@它。由于Coworker Agent拥有独立身份,因此相关操作也会留下相应记录,便于进行管理和追踪。
模型调用方面,Gemini Agent能够根据任务需求,在谷歌自有Gemini系列模型和Anthropic的Claude系列模型之间动态选择,用户可在任务效果、执行速度和成本之间进行权衡,并提供权限管理、审计、沙箱及实时支出上限等企业级控制功能。
谷歌方面还为Gemini Agent提供面向数据分析、数据工程和机器学习的新技能,并推出针对金融服务和法律行业的专业化版本。

近期,谷歌方面持续推进Gemini系列模型及相关AI产品迭代。今年5月,谷歌在Google I/O大会上发布Gemini 3.5 Flash、Gemini Omni,并更新智能体编程平台Google Antigravity,同时推出个人AI助手Gemini Spark。当时官方公布的数据显示,Gemini应用月活用户已超过9亿。
9月2日,谷歌发布Gemini 3.8 Flash,重点提升软件工程、智能体任务及多步骤推理能力。9月15日推出Gemini 3.8 Live和Gemini 3.8 Live Extended Thinking,强化实时语音交互、视觉理解及复杂任务处理能力。9月24日,谷歌推出Gemini 3.8 Live with Live Avatar,将实时视频生成加入对话体验。
不久前,谷歌DeepMind高管Koray Kavukcuoglu在AI Agenda Live Summit上透露,Gemini 4的基础训练已经完成,目前进入后训练阶段,并计划“远早于年底”发布。
【本文图片来自网络】
