A5站长网10月9日消息,在谷歌云2026年的年度活动Gemini at Work上,谷歌云首席执行官Thomas Kurian发布了一款叫Gemini agent的办公智能体。按官方博客的说法,这是一个单一的、通用的工作Agent,从回答问题、处理知识型工作,到生成图片和视频、编写并运行代码,都走同一个提示框。谷歌给它的使用原则只有一句:给它目标,而不是逐步指令。
它能干活的地方主要是谷歌自家的Workspace。在Gmail、Drive、Docs、Slides、Sheets、Chat和Calendar里,这个Agent可以直接操作,并且带着同一套记忆、技能和控制策略。访问入口并不限于谷歌体系,官方列出的范围包括Web、iOS和Android手机、Windows和Mac桌面,以及命令行、微软365和Slack;它还能以没有独立界面的方式被集成进第三方应用。
运行方式上,Agent跑在云端,记忆和上下文跟着账号走,不跟着设备走,所以关掉笔记本电脑之后任务还能继续,回来时结果还在。官方把它掌握的东西分成四类记忆:会话记忆保存当前任务的上下文,语义记忆把读过的文档和对话整理成结构化知识,程序性记忆记下一项工作该怎么完成,情景记忆记录过去做过哪些事。它还能自己写Skills,把过程中学到的方法存下来给后续任务用。
协作上,它可以根据任务临时拉起一批子Agent,每个子Agent有各自的身份,并行或串行地推进,跑上几小时甚至几天。更特别的是同事Agent这个设定:企业可以给它一个长期的企业身份,配独立邮箱、日历和存储空间,让它出现在公司通讯录里,团队成员可以像对待普通人一样把它拉进群聊,或者在文档里@它。它的操作会留下记录,能访问的范围也限于团队主动开放的那部分。
模型选择上,谷歌这次明确不绑自家。官方说,Gemini agent可以在Gemini系列和Anthropic的Claude系列之间动态选择,未来还计划支持更多闭源与开源模型,谷歌把这件事称为多模型编排;配套的Smart Routing会根据效果、速度和成本给任务分配模型,简单活儿用便宜的,复杂任务调能力更强的。管理员可以在项目层面设置支出上限,达到阈值后Agent会自动暂停。谷歌同时强调,底层模型可以换,但Agent积累的上下文、Skills和企业数据会保留下来。
可用性方面,这款产品目前处于小范围预览,官方计划先向Workspace里特定的Business和Enterprise方案开放。面向金融和法律行业的版本也在预览,政府、医疗和零售版本官方说的是后续推出。谷歌给出的参考规模是:过去一年有近500家Google Cloud客户各自处理了超过1万亿token,近80%的客户在用它的AI产品,财富100强里有近90%是Gemini Enterprise客户。企业Agent这条线上,Meta在9月推出了Muse,OpenAI上个月发布了Dots,谷歌算是第三家入场的巨头。
A5创业网 版权所有