Insights·2026-10-05

チームで使うAIは何が違うのか — ChatGPT Space・Grok Team Bots・Claude Code mods・Gemini 4 Argon

2026年9月最終週の発表を一言でまとめると、AIは一人で使うアシスタントから、チームで共有する同僚へと移りつつある。OpenAIはDevDayでチーム共用の空間ChatGPT Spaceと、人とエージェントが一緒に編集する文書Pagesを発表し、xAIはチームで共有するGrok Team Botsを、AnthropicはClaude Codeの動作を書き換えられるmodsを出した。GoogleのGemini 4 Argonは一度に100万トークンの長さの回答を書いて長い仕事を担い、OpenAIのDecisions APIとオープンソースのStrands Decider 2Bは、決められた選択肢から答えを選ぶ小さな判定モデルを打ち出した。チームにAIの同僚を迎えるときに確かめることは三つある。何がチームに見えて何が自分だけに残るのか、選ぶだけで済む仕事を大きなモデルに任せていないか、追加した拡張機能がどんな権限で動くのか。

AI가 팀 동료로 들어올 때 챙길 세 가지. 공유 경계 — Team Bots는 봇은 공유하되 대화·기억은 사람마다 따로 두니 도입 전 공유 공간과 개인 대화를 나눈다. 판정 분리 — Decisions API·Decider 2B 같은 판정 모델에 문의 분류·담당 배정·값 확인을 떼어 낸다. 확장 권한 — Claude Code mods는 격리 없이 내 컴퓨터 권한으로 도니 설치 목록을 만들고 관리자 허용·차단 설정부터 켠다 — 글의 요약 도식

一人で使っていたチャット画面がチームの作業場になった

OpenAIは9月29日(現地時間)、開発者イベントDevDayで20を超える発表を行った。中でもチーム側の変化が大きい。ChatGPT Spaceは、チームメンバーとChatGPT、そしてOpenAIの常駐エージェントdotが同じ資料を積み上げて作業を続ける共用空間だ。エージェントとは、目標を受け取って複数の手順を自ら進めるAIプログラムのことだ。指示を残しておけば、ChatGPTが空間を整理してくれる。Pro・Business・Enterpriseプランのデスクトップアプリとウェブで使え、モバイルでは検索・閲覧・共有が先に使える。

Pagesは、人とエージェントが一緒に編集する新しい文書形式だ。会話からページを作ってチームメンバーを招き、意見をもらいながら、ページの中でそのまま執筆・調査・グラフ作成・画像生成ができる。複数人が同時に編集できるスライドは数週間以内に登場する。Business・Enterpriseでは、週次報告のような繰り返しの仕事をチームタスクに任せ、決まった時刻や新しいメール・Slackメッセージが届いたときに動かせる。プラグインはChatGPTに外部の機能を加える部品で、macOSデスクトップアプリのMeetingsプラグイン(ベータ)は会議メモとToDoをSpaceに残し、メモができると録音を削除する。

その前日の9月28日、xAIはGrok Team BotsをTeams・Enterpriseプランで公開ベータとして出した。一つの役割を担うボットを作り、ファイルと指示、業務アプリとの連携、外部サービスへの接続キー、仕事の中で学んだ記憶を与えてチームに共有する仕組みだ。ボットはチームで共用するが、会話と記憶は人ごとに分けて保つ。Slackには自分の名前で参加し、チャンネルで質問を受ける。xAIは社内で主要な営業先ごとにボットを一つずつ置き、夜のうちに通話記録・文書・Slackのやり取りに目を通して、毎朝担当者ごとの次の作業を投稿させていると紹介した。

AIツールをチームのルールに合わせて作り替える — Claude Code mods

Anthropicは10月1日、Claude Codeにmodsを加えた。Claude Codeは、会話でコード作業を任せるAnthropicのAIツールだ。modは数行のTypeScript(ウェブ開発で広く使われるプログラミング言語)の関数で、Claude Codeがツールを呼ぶ、権限を尋ねる、画面を描くといったたびに出す信号に割り込む。その処理の前や後に動くことも、処理そのものを置き換えることもできる。自分で書いても、Claude Codeに書かせてもよい。

これまでのフック(決まったタイミングでコマンドを実行する仕組み)ではできなかったことができる。ツールの出力から秘密の値を消してからClaudeに渡す、画面にボタンや入力欄を加える、標準機能を差し替える、といったことだ。組み込みの/diff機能も今やmodなので、オフにしたり自作のものに替えたりできる。Anthropicはチーム向けの例として、自動チェックの進み具合を会話の横の枠に表示するmod、本番環境の設定に触れるコマンドの前に確認を求めるmod、ほかのmodの呼び出しをすべて記録するmodを挙げた。

注意点もはっきりしている。modは隔離された環境に閉じ込められず、Claude Codeと同じ権限で自分のパソコン上で動く。Anthropicも信頼できる提供元からのみ入れるよう書いている。modはプラグインに入れて配布されるため、管理者がプラグインのマーケットプレイスを許可・遮断する既存の管理がそのまま効く。Team・Enterpriseプランと管理設定が入ったパソコンでは、sec-defaultという組み込みmodが最初に読み込まれ、ユーザーが入れたmodが権限の拒否ルールを上書きするといった危険な動作を止める。

選ぶだけの仕事は小さな判定モデルへ — Decisions API・Strands Decider 2B

判定モデルとは、決められた選択肢から一つを選び、その答えをどこまで信じてよいかを示すスコアを一緒に返すモデルだ。文章を書けない代わりに、速くて安い。「この問い合わせを決済チーム・営業チーム・店舗のどこに回すか」のように、答えが選択肢の中にある仕事が向いている。

OpenAIはDevDayでDecisions APIを限定プレビューとして出した。APIとは、プログラム同士が機能をやり取りする窓口のことだ。開発者が質問と決まった答えのリストを渡し、文章や画像で状況を伝えると、Lunaモデルがその中から答えを選ぶ。コンテンツの分類、リクエストの振り分け、エージェントの次の行動選びに使うものだとOpenAIは説明し、数日以内に広く公開するとした。

10月1日には、オープンソースのエージェント開発ツールStrands Agentsのチームが、判定モデルStrands Decider 2Bを公開した。オープンソースとは、誰でも持ち出して手直しして使えるようにコードを公開することだ。パラメータ(モデルが学習で調整する内部の数値)20億個の小さなモデルで、言語モデルQwen3.5-2Bから文章を生み出す部分を外し、選択肢ごとに点数を付ける部品を付けた。学習データとスクリプトまでGitHubとHugging Faceで公開している。チームによると、1回の判定にかかった時間の中央値はRTX 3090グラフィックカードで約115ミリ秒、M3 MacBookでは小さな作業で約153ミリ秒だった。

Strandsチームは、この種のモデルが9月のTypeSafe AIによるJev公開以降、注目を集めていると書き、用途としてモデル選び、ツール選び、安全チェックを挙げた。公開された例では、エージェントがユーザーの言っていない都市をでっち上げて天気ツールを呼ぼうとすると、判定モデルが先に「この値はユーザーが言ったものか」を判定し、エージェントがユーザーに聞き返すようにする。難しい判断は大きなモデルに、繰り返しの簡単な判断は判定モデルに分ければ、コストと待ち時間が減るというのがチームの説明だ。

モデル側:より長く書き、より速く話す

Gemini 4 Argon が一度に出せる回答の最大長を6万4千トークンから100万トークンに伸ばした差を示す棒グラフ

Googleは9月30日、Gemini 4 Argonを発表した。一度に出せる回答の最大の長さを6万4千トークンから100万トークンに広げた。トークンとは、AIが文章を読み書きするときに細かく区切って数える断片のことだ。長いコードの移行や何段階もの調査を一度で終わらせるための設計だ。Googleは社内でC/C++のコードをRust(メモリの誤りを防ぐのに強いプログラミング言語)に移す作業にすでに使っており、動画デコードソフトlibgav1のRust版を手直しして2.7倍速くしたと明らかにした。

公開は段階的だ。まずFairwindプログラムを通じて信頼できるサイバー防御機関に提供し、彼らにはセキュリティ面の安全装置を外した状態で渡す。その後、有料APIの顧客とGoogle AI Ultraの購読者の順に広げる。発売価格は入力100万トークンあたり2ドル・出力10ドルで、導入期間が終わると4ドル・20ドルになる。

音声の側では、反応の速さが人の会話の間合いほどにまで縮まった。ElevenLabsは9月28日、音声合成モデルEleven v4と高速応答版のv4 Turboを出した。Turboはリクエストから最初の音までの中央値が約150ミリ秒で、どちらのモデルも90を超える言語を話し、10秒の録音で声を複製する。Microsoftは10月1日、リアルタイム文字起こしモデルMAI-Transcribe-2-Streamingを出した。話し終わる前、音を受け取ってから100ミリ秒あまりで最初の文字起こしを出して直していき、60言語を扱う。年末まで音声1時間あたり0.54ドルだ。同じ日に出た音声合成のMAI-Voice-2.1-Flashは100万文字あたり15ドルだ。

画像の側では、Ideogram 4.5が何度直しても絵が崩れない編集を打ち出した。編集のたびに画素がずれたり色が変わったりする現象を減らし、高解像度の写真を縮小せずに一部だけを直せると同社は説明している。

チームにAIの同僚を迎えるときに確かめる三つのこと

第一に、何がチームに見えて何が自分だけに残るのか。Team Botsはボットを共用しながら会話と記憶を人ごとに分けて保ち、Meetingsプラグインは会議メモを自分だけで見るかチームと共有するかを選ばせる。導入の前に、共有空間に入れる資料と個人の会話に残す資料の境目を決めておく。

第二に、選ぶだけで済む仕事を大きなモデルに任せていないか。問い合わせの分類、担当の割り振り、「この値はユーザーが言ったものか」といった確認は、決まった選択肢の中で答えが出る。こうした仕事を判定モデルに切り出せば速くて安く、答えごとにどこまで信じてよいかが数字で付く。

第三に、追加した拡張機能がどんな権限で動くのか。Claude Code modsは隔離なしで自分のパソコンの権限で動き、Team Botsは外部サービスへの接続キーを受け取る。誰が何を入れたかの一覧を作り、管理者レベルの許可・遮断設定から有効にする。

確認項目今週の発表で見た根拠最初にやること
共有と個人の境目ChatGPT Space・Pages、Team Botsのユーザー別の会話と記憶、Meetingsメモの共有選択共有空間に入れる資料と個人の会話に残す資料を分ける
判定と生成の分離OpenAI Decisions API、Strands Decider 2B分類・割り振り・確認など答えが選択肢の中にある業務を書き出す
拡張機能の権限Claude Code mods(隔離なし、sec-default)、Team Botsの外部接続キーインストール一覧を作り、マーケットプレイスの許可・遮断を設定する