Insights·2026-10-05

团队共用的AI有何不同 — ChatGPT Space、Grok Team Bots、Claude Code mods、Gemini 4 Argon

把2026年9月最后一周的发布归成一句话:AI正从一个人用的助手,转向团队共用的同事。OpenAI在DevDay上推出了团队共用空间ChatGPT Space和人与智能体共同编辑的文档Pages;xAI推出了团队共享的Grok Team Bots;Anthropic为Claude Code加入了可改写其行为的mods。谷歌的Gemini 4 Argon一次可写出长达100万token的回答,用来承担长时间任务;OpenAI的Decisions API和开源的Strands Decider 2B则带来了从固定选项中作答的小型判定模型。把AI同事引入团队时要核对三件事:哪些内容团队可见、哪些只留给自己;是否把只需选一个答案的工作交给了大模型;附加的扩展功能以什么权限运行。

AI가 팀 동료로 들어올 때 챙길 세 가지. 공유 경계 — Team Bots는 봇은 공유하되 대화·기억은 사람마다 따로 두니 도입 전 공유 공간과 개인 대화를 나눈다. 판정 분리 — Decisions API·Decider 2B 같은 판정 모델에 문의 분류·담당 배정·값 확인을 떼어 낸다. 확장 권한 — Claude Code mods는 격리 없이 내 컴퓨터 권한으로 도니 설치 목록을 만들고 관리자 허용·차단 설정부터 켠다 — 글의 요약 도식

一个人用的对话框变成了团队工作空间

OpenAI于9月29日(当地时间)在开发者大会DevDay上发布了20多项内容,其中团队方面的变化最大。ChatGPT Space是团队成员、ChatGPT与OpenAI常驻智能体dot共同积累资料、接续工作的共用空间。智能体是接收目标后自行完成多个步骤的AI程序。留下指示后,ChatGPT会自行整理空间。它在Pro、Business、Enterprise套餐的桌面应用和网页版上可用,移动端先支持查找、阅读和分享。

Pages是人与智能体共同编辑的新型文档。在对话中创建页面后,可邀请同事提意见,并直接在页面里写作、调研、生成图表和图片。多人可同时编辑的幻灯片将在几周内推出。在Business和Enterprise上,周报这类重复性工作可以交给团队任务,按设定时间或在收到新邮件、新Slack消息时运行。插件是为ChatGPT附加外部功能的组件;macOS桌面应用中的Meetings插件(测试版)会把会议笔记和待办事项存入Space,笔记生成后即删除录音。

早一天的9月28日,xAI在Teams和Enterprise套餐上以公开测试版推出Grok Team Bots。做法是围绕一个角色创建机器人,给它文件与指示、工作应用连接、外部服务访问密钥以及工作中学到的记忆,再分享给团队。团队共用机器人,但每个人的对话和记忆分开保存。它会以自己的账号加入Slack,在频道中回答问题。xAI介绍说,公司内部每个重要销售客户都有一个专属机器人,夜间浏览通话记录、文档和Slack讨论,每天早上发布每位负责人的下一步工作。

按团队规则改造AI工具 — Claude Code mods

Anthropic于10月1日为Claude Code加入mods。Claude Code是Anthropic通过对话完成编程工作的AI工具。mod是几行TypeScript(一种广泛用于网页开发的编程语言)函数,会插入Claude Code在调用工具、请求权限或绘制界面时发出的信号。它可以在该事件之前或之后运行,也可以直接替代它。可以自己编写,也可以让Claude Code代写。

现有的钩子(在固定时点执行命令的机制)做不到的事,mod能做到:在Claude读取之前从工具输出中删除机密信息、在界面上添加按钮和输入框、替换内置功能。内置的/diff功能如今也是mod,可以关闭或换成自己的版本。Anthropic给出的团队示例包括:在对话旁的面板显示自动检查进度的mod、在任何命令触及生产环境设置前要求确认的mod,以及记录其他mod全部调用的mod。

需要注意的地方也很明确。mod不在隔离环境中运行,而是以与Claude Code相同的权限在你的电脑上运行,Anthropic也写明只应从可信来源安装。mod封装在插件中分发,因此管理员允许或屏蔽插件市场的既有管控依然适用。在Team、Enterprise套餐以及装有托管设置的电脑上,一个名为sec-default的内置mod会最先加载,阻止用户安装的mod执行覆盖权限拒绝规则等危险操作。

只需选择的工作交给小型判定模型 — Decisions API与Strands Decider 2B

判定模型是从固定选项中选出一个答案,并同时给出该答案可信程度分数的模型。它不能生成文字,但换来了速度快、成本低。适合答案就在选项之内的工作,比如判断一条咨询该转给结算组、销售组还是门店。

OpenAI在DevDay上以有限预览形式推出Decisions API。API是程序之间交换功能的接口。开发者提供问题和固定的答案列表,再以文字或图片传入情境,Luna模型就会从中选出答案。OpenAI表示它适用于内容分类、请求分配和选择智能体的下一步行动,并计划在几天内广泛开放。

10月1日,开源智能体开发工具Strands Agents团队发布了判定模型Strands Decider 2B。开源是指公开代码,任何人都可以拿去修改使用。这是一个拥有20亿个参数(模型通过训练调整的内部数值)的小模型:团队以语言模型Qwen3.5-2B为基础,去掉生成文字的部分,接上为每个选项打分的组件,并把训练数据和脚本一并公开在GitHub和Hugging Face上。团队公布,单次判定耗时的中位数在RTX 3090显卡上约为115毫秒,在M3 MacBook上处理小任务约为153毫秒。

Strands团队写道,自9月TypeSafe AI发布Jev以来,这类模型备受关注,用途包括选择模型、选择工具和安全检查。在其公开示例中,智能体编造了一个用户没提到的城市去调用天气工具,判定模型先判断这个值是否出自用户,于是智能体转而向用户确认。团队的解释是:把难的判断交给大模型、把重复的简单判断交给判定模型,可以降低成本和等待时间。

模型方面:写得更长,说得更快

条形图:Gemini 4 Argon 将单次回答的最大长度从 6.4 万 token 提高到 100 万 token

谷歌于9月30日发布Gemini 4 Argon,把单次回答的最大长度从6.4万token提高到100万token。token是AI读写文字时切分计数的小片段。这一设计旨在一次完成长篇代码迁移或多步骤调研。谷歌表示,公司内部已在用它把C/C++代码迁移到Rust(一种擅长防止内存错误的编程语言),并改进了视频解码软件libgav1的Rust版本,使其速度提升2.7倍。

开放是分阶段的。首先通过Fairwind计划提供给可信的网络防御机构,并为它们关闭网络安全方面的防护限制;之后依次是付费API客户和Google AI Ultra订阅用户。上市价格为每100万输入token 2美元、输出10美元,推广期结束后为4美元和20美元。

语音方面,响应速度已缩短到人类对话间隙的长度。ElevenLabs于9月28日发布语音合成模型Eleven v4和快速响应版v4 Turbo。Turbo从请求到发出第一个声音的中位数约为150毫秒,两款模型都支持90多种语言,并能用10秒录音克隆声音。微软于10月1日发布实时转写模型MAI-Transcribe-2-Streaming,在说话人说完之前、收到声音后仅100毫秒出头就给出第一版转写并持续修正,支持60种语言,年底前每小时音频0.54美元。同日发布的语音合成模型MAI-Voice-2.1-Flash为每100万字符15美元。

图像方面,Ideogram 4.5主打多次修改也不走样的编辑。公司称它减少了每次编辑带来的像素偏移和颜色变化,并能在不缩小高分辨率照片的情况下只修改局部。

把AI同事引入团队前要核对的三件事

第一,哪些内容团队可见、哪些只留给自己。Team Bots虽由团队共用,但每个人的对话和记忆分开保存;Meetings插件允许选择会议笔记是自己看还是与团队共享。引入之前,先划定放进共享空间的资料与留在个人对话中的资料之间的界线。

第二,是否把只需选一个答案的工作交给了大模型。咨询分类、负责人分配、以及“这个值是不是用户说的”这类核对,答案都在固定选项之内。把这些工作拆给判定模型更快更省,而且每个答案都附带可信程度的数值。

第三,附加的扩展功能以什么权限运行。Claude Code mods在没有隔离的情况下以你电脑的权限运行,Team Bots会拿到外部服务的访问密钥。列出谁安装了什么,并先开启管理员层面的允许与屏蔽设置。

核对项本周发布中的依据第一步
共享与个人的界线ChatGPT Space与Pages、Team Bots按用户分开的对话与记忆、Meetings笔记的共享选择区分放入共享空间的资料与留在个人对话的资料
判定与生成的分离OpenAI Decisions API、Strands Decider 2B列出分类、分配、核对等答案在固定选项内的工作
扩展功能的权限Claude Code mods(无隔离、sec-default)、Team Bots的外部访问密钥建立安装清单并设置插件市场的允许与屏蔽