혼자 쓰던 대화창이 팀 작업 공간이 됐다
오픈AI는 9월 29일(현지시간) 개발자 행사 DevDay에서 20개 넘는 발표를 냈다. 그중 팀 쪽 변화가 크다. ChatGPT Space는 팀원과 ChatGPT, 오픈AI의 상시 에이전트 dot이 같은 자료를 쌓아 두고 이어 쓰는 공용 공간이다. 에이전트는 목표를 받아 여러 단계를 스스로 처리하는 AI 프로그램이다. 지시를 남겨 두면 ChatGPT가 공간을 알아서 정리한다. Pro·Business·Enterprise 요금제의 데스크톱 앱과 웹에서 쓰고, 모바일은 찾기·읽기·공유가 먼저 된다.
Pages는 사람과 에이전트가 함께 고치는 새 문서 형식이다. 대화에서 페이지를 만든 뒤 팀원을 불러 의견을 받고, 페이지 안에서 글쓰기·조사·차트·이미지 생성을 그대로 한다. 여럿이 동시에 고치는 슬라이드는 몇 주 안에 나온다. Business·Enterprise에서는 주간 보고 같은 반복 업무를 팀 작업으로 맡겨, 정해진 시각이나 새 메일·Slack 메시지가 올 때 돌게 한다. 플러그인은 ChatGPT에 바깥 기능을 덧붙이는 부품인데, macOS 데스크톱 앱의 Meetings 플러그인(베타)은 회의 노트와 할 일을 Space에 남기고 노트가 만들어지면 녹음은 지운다.
xAI는 하루 앞선 9월 28일 Grok Team Bots를 Teams·Enterprise 요금제에 공개 베타로 냈다. 역할 하나를 맡을 봇을 만들어 파일과 지침, 업무 앱 연결, 외부 서비스 접속 열쇠, 일하며 배운 기억을 주고 팀에 공유하는 방식이다. 봇은 팀이 같이 쓰지만 사람마다 대화와 기억은 따로 둔다. Slack에는 자기 이름으로 들어가 채널에서 질문을 받는다. xAI는 사내에서 영업 고객사마다 봇을 하나씩 두고, 밤새 통화 기록·문서·Slack 대화를 훑어 아침마다 담당자별 할 일을 올리게 한다고 소개했다.
AI 도구를 팀 규칙에 맞게 고쳐 쓴다 — Claude Code mods
앤트로픽은 10월 1일 Claude Code에 mods를 넣었다. Claude Code는 대화로 코드 작업을 시키는 앤트로픽의 AI 도구다. mod는 몇 줄짜리 TypeScript(웹 개발에 널리 쓰는 프로그래밍 언어) 함수로, Claude Code가 도구를 부르거나 권한을 묻거나 화면을 그릴 때마다 내는 신호에 끼어든다. 그 일의 앞이나 뒤에서 돌거나, 아예 대신 돈다. 직접 짜도 되고 Claude Code에게 짜 달라고 해도 된다.
기존 훅(정해진 시점에 명령을 실행하는 장치)으로는 못 하던 일이 된다. 도구 결과에서 비밀값을 지운 뒤 Claude에게 넘기고, 화면에 버튼과 입력칸을 붙이고, 기본 기능을 갈아 끼운다. 내장 /diff 기능도 이제 mod라 끄거나 내 것으로 바꿀 수 있다. 앤트로픽은 팀용 예시로 자동 검사 진행 상황을 대화 옆 창에 띄우는 mod, 실제 서비스 설정을 건드리는 명령 앞에서 확인을 받는 mod, 다른 mod의 호출을 전부 기록하는 mod를 들었다.
주의할 점도 분명하다. mod는 격리된 공간에 갇히지 않고 Claude Code와 같은 권한으로 내 컴퓨터에서 돈다. 앤트로픽도 믿을 수 있는 곳에서만 설치하라고 적었다. mod는 플러그인에 담겨 배포되므로 관리자가 플러그인 마켓플레이스(플러그인을 모아 내려받는 곳)를 허용·차단하는 기존 통제가 그대로 걸린다. Team·Enterprise 요금제와 관리 설정이 깔린 컴퓨터에서는 sec-default라는 내장 mod가 먼저 올라와, 사용자가 설치한 mod가 권한 거부 규칙을 덮어쓰는 것 같은 위험한 동작을 막는다.
고르기만 하면 되는 일은 작은 판정 모델로 — Decisions API·Strands Decider 2B
판정 모델은 정해진 보기 중 하나를 고르고, 그 답을 얼마나 믿어도 되는지 점수를 함께 내는 모델이다. 글을 지어내지 못하는 대신 빠르고 싸다. '이 문의를 결제팀·영업팀·매장 중 어디로 보낼까'처럼 답이 보기 안에 있는 일이 맞는 자리다.
오픈AI는 DevDay에서 Decisions API를 제한 프리뷰(일부에게 먼저 여는 시험판)로 냈다. API는 프로그램끼리 기능을 주고받는 창구다. 개발자가 질문과 정해진 답 목록을 주고 글이나 이미지로 상황을 넘기면, Luna 모델이 그 안에서 답을 고른다. 콘텐츠 분류, 요청 배분, 에이전트의 다음 행동 고르기에 쓰라는 것이 오픈AI 설명이고, 며칠 안에 넓게 풀겠다고 했다.
10월 1일에는 오픈소스 에이전트 개발 도구 Strands Agents 팀이 판정 모델 Strands Decider 2B를 공개했다. 오픈소스는 코드를 누구나 가져다 고쳐 쓰게 공개한다는 뜻이다. 매개변수(모델이 학습으로 맞춘 내부 숫자) 20억 개짜리 작은 모델로, 언어 모델 Qwen3.5-2B에서 글을 만드는 부분을 떼고 보기마다 점수를 매기는 부품을 달았다. 학습 데이터와 스크립트까지 GitHub와 Hugging Face(코드와 AI 모델을 올려 두는 공유 사이트)에 풀었다. 판정 한 번에 걸린 시간의 중앙값(가운데 값)은 RTX 3090 그래픽카드에서 약 115밀리초(1밀리초는 1000분의 1초), M3 맥북에서는 작은 작업 기준 약 153밀리초였다고 팀은 밝혔다.
Strands 팀은 이런 모델이 9월 TypeSafe AI의 Jev 공개 뒤 주목받고 있다고 적었다. 쓰임새로는 모델 고르기, 도구 고르기, 안전 점검을 들었다. 공개 예제에서 에이전트가 사용자가 말하지 않은 도시를 지어내 날씨 도구를 부르려 하자, 판정 모델이 '이 값은 사용자가 말한 것인가'를 먼저 물어 에이전트가 사용자에게 되묻게 만든다. 어려운 판단은 큰 모델에, 반복되는 쉬운 판단은 판정 모델에 나누면 비용과 대기 시간이 준다는 것이 팀의 설명이다.
모델 쪽: 더 길게 쓰고, 더 빨리 말한다

구글은 9월 30일 Gemini 4 Argon을 발표했다. 한 번에 내놓을 수 있는 답의 최대 길이를 6만4천 토큰에서 100만 토큰으로 늘렸다. 토큰은 AI가 글을 읽고 쓸 때 잘게 쪼개 세는 조각이다. 긴 코드 이전이나 여러 단계 조사를 한 번에 끝내라는 설계다. 구글은 사내에서 오래 쓰여 온 C/C++ 코드를 Rust(메모리 실수를 막는 데 강한 프로그래밍 언어)로 옮기는 데 쓰고 있고, 동영상 해독 소프트웨어 libgav1의 Rust 판을 손봐 2.7배 빠르게 만들었다고 밝혔다.
공개는 단계적이다. 먼저 Fairwind 프로그램으로 신뢰할 수 있는 사이버 방어 기관에 풀고, 이들에게는 보안 쪽 안전장치를 끈 상태로 준다. 그다음 유료 API 고객과 Google AI Ultra 구독자 순이다. 출시 가격은 입력 100만 토큰당 2달러·출력 10달러이고, 도입 기간이 끝나면 4달러·20달러가 된다.
음성 쪽은 반응 속도가 사람 대화의 틈만큼 짧아졌다. ElevenLabs는 9월 28일 음성 합성(글을 목소리로 바꾸는 기술) 모델 Eleven v4와 빠른 응답판 v4 Turbo를 냈다. Turbo는 요청부터 첫 소리까지 중앙값 약 150밀리초이고, 두 모델 모두 90개 넘는 언어를 말하며 10초 녹음으로 목소리를 복제한다. 마이크로소프트는 10월 1일 실시간 받아쓰기 모델 MAI-Transcribe-2-Streaming을 냈다. 말이 끝나기 전, 소리를 받은 지 100밀리초 남짓 만에 첫 받아쓰기를 내고 고쳐 가며 60개 언어를 다룬다. 연말까지 오디오 1시간에 0.54달러다. 같은 날 낸 음성 합성 MAI-Voice-2.1-Flash는 100만 글자당 15달러다.
이미지 쪽에서는 Ideogram 4.5가 여러 번 고쳐도 그림이 무너지지 않는 편집을 내세웠다. 고칠 때마다 화소가 밀리고 색이 바뀌는 현상을 줄였고, 고해상도 사진을 줄이지 않은 채 일부만 고친다고 회사는 설명한다.
팀에 AI 동료를 들일 때 챙길 세 가지
첫째, 무엇이 팀에 보이고 무엇이 나에게만 남는지다. Team Bots는 봇을 같이 쓰되 대화와 기억을 사람마다 따로 두고, Meetings 플러그인은 회의 노트를 혼자 볼지 팀과 나눌지 고르게 한다. 도입 전에 공유 공간에 넣을 자료와 개인 대화로 남길 자료의 경계를 정해 둔다.
둘째, 고르기만 하면 되는 일을 큰 모델에 맡기고 있지 않은지다. 문의 분류, 담당 배정, '이 값이 사용자가 말한 것인가' 같은 확인은 정해진 보기 안에서 답이 나온다. 이런 일은 판정 모델로 떼어 내면 빠르고 싸며, 답마다 믿을 만한 정도가 숫자로 붙는다.
셋째, 덧붙인 확장 기능이 어떤 권한으로 도는지다. Claude Code mods는 격리 없이 내 컴퓨터 권한으로 돌고, Team Bots는 외부 서비스 접속 열쇠를 받는다. 누가 무엇을 설치했는지 목록을 만들고, 관리자 차원의 허용·차단 설정부터 켠다.
| 점검 항목 | 이번 주 발표에서 본 근거 | 먼저 할 일 |
|---|---|---|
| 공유와 개인의 경계 | ChatGPT Space·Pages, Team Bots의 사용자별 대화·기억, Meetings 노트 공유 선택 | 공유 공간에 넣을 자료와 개인 대화로 둘 자료 구분 |
| 판정과 생성의 분리 | 오픈AI Decisions API, Strands Decider 2B | 분류·배정·확인처럼 답이 보기 안에 있는 업무 목록 뽑기 |
| 확장 기능의 권한 | Claude Code mods(격리 없음, sec-default), Team Bots의 외부 접속 열쇠 | 설치 목록 작성과 마켓플레이스 허용·차단 설정 |
