
在谷歌云活动上,该公司宣布将Gemini AI带入“智能体时代”,正式推出一款统一智能体。该智能体不仅能回答问题,还能通过单一界面代表用户执行任务。
这一举措顺应了AI工具从单纯对话向接管指定任务、生成代码、安排会议及处理其他事务演进的趋势。此举也与Meta Muse、Instinct以及ChatGPT新推出的Dots功能等智能体产品的兴起相呼应。
先企后C,规模化落地
谷歌在推动智能体规模化应用方面具备显著优势。谷歌CEO桑达尔·皮查伊指出,Gemini目前月活跃用户已超10亿,近90%的财富100强企业正在工作中使用Gemini Enterprise。
鉴于其在企业界的普及度,谷歌将优先面向企业客户推出该智能体,随后再拓展至消费者市场。皮查伊表示,这一策略有助于解决强大智能体在推出时面临的关于安全、规模和性能等更复杂的问题。
赋予“目标”而非仅“指令”
谷歌云CEO托马斯·库吉安解释称,新智能体可被赋予“目标,而不仅仅是指令”。它具备规划工作、调用自定义技能和工具的能力,并能连接企业内部系统以实现目标。
默认情况下,AI会自动选择最佳模型完成任务,但用户也可手动选择模型,包括来自第三方的模型,首批支持Anthropic的Claude。谷歌表示,未来将把开源模型和其他私有模型纳入模型选择器。
请求可包含文件、文件夹等为特定工作流程设计的项目。智能体能连接Google Workspace、Microsoft 365、Slack、Jira、Confluence、Git、BigQuery、Databricks、Postgres、Snowflake等企业数据和系统,并可通过模型上下文协议(MCP)服务器在公司网络内外进行安全连接和工作。
独立身份与全平台覆盖
用户可以通过“任务收件箱”界面跟踪Gemini的操作,查看其思考过程、委派给子智能体的任务、技能加载情况、代码执行进度等。
值得注意的是,该AI拥有独立的Workspace账户,如同另一位同事。它具备独立的邮箱地址和上下文信息,了解团队归属、时区、审批流程及日历安排等信息。用户可通过@提及、发送邮件、共享内容或将其加入群聊来调用。在执行操作时,它会生成归属于智能体而非个人的审计轨迹。
该智能体支持iOS、Android移动端,Windows、Mac桌面端,以及命令行界面、Google Workspace、Microsoft 365、ServiceNow和Slack等平台。
早期测试者包括运动品牌On、Shopify和PayPal。此外,BNP Paribas、Bradesco、默克、Orange Spain、Santee Cooper、SOMPO、Ulta Beauty和Wesfarmers等大型企业与机构也是Gemini Enterprise的客户。
谷歌还推出了包括多模型编排、智能路由和实时支出上限在内的灵活支出选项,以帮助企业更好地控制企业级AI成本。