Joonmook 프로필 사진

@Joonmook

Blog

OpenAI dots 정리: 상시 실행 에이전트는 뭐가 다른가

OpenAI dots 정리: 상시 실행 에이전트는 뭐가 다른가 썸네일

9월 29일 OpenAI DevDay의 주인공은 새 모델이 아니라 dots였다. OpenAI는 이걸 "상시 실행 에이전트(always-on agents)"라고 부른다. 발표 이후 이게 정확히 뭔지, 기존 ChatGPT나 Codex와 뭐가 다른지 묻는 글이 많아서 공개된 내용을 기준으로 정리해 둔다.

한 줄로 말하면

지금까지의 챗봇은 내가 말을 걸 때만 일했다. 창을 닫으면 끝이다. dot은 반대다. 목표를 하나 주면 자기 클라우드 컴퓨터에서 계속 일하고, 결과가 나오면 가져와서 확인을 받는다. 내가 자고 있어도 일은 돌아간다.

구성 요소

  1. 모델. 9월 3일에 나온 GPT-6 Astra 위에서 돈다.
  2. 전용 컴퓨터. dot마다 클라우드 컴퓨터와 브라우저가 따로 붙는다. 사이트에 들어가고, 클릭하고, 파일을 만드는 일을 거기서 한다. 내가 그 화면을 열어서 지금 뭘 하고 있는지 지켜볼 수도 있고, 허락하면 내 노트북에 연결할 수도 있다.
  3. 앱 연결. 플러그인으로 4,000개가 넘는 앱에 붙는다. 메일, 캘린더, 문서, 코드 저장소 같은 것들이다.
  4. 기억. 대화가 끝나도 기억이 이어진다. 피드백을 주면 그걸 배워서 다음 일에 반영한다.
  5. 대화 창구. ChatGPT 데스크톱·웹·모바일, Slack, Teams에서 말을 걸 수 있고, 음성 통화도 된다.

"상시 실행"이 실제로 뜻하는 것

핵심은 두 가지다.

첫째, 긴 일을 맡길 수 있다. "이 제안서 진행 상황을 계속 추적해 줘", "받은편지함에서 내가 답해야 할 걸 챙겨줘" 같은, 한 번에 끝나지 않는 일이다. dot은 이런 일을 여러 백그라운드 에이전트로 나눠서 병렬로 처리한다.

둘째, 시키지 않은 일을 먼저 찾는다. 내가 말을 걸지 않는 동안 연결된 앱을 둘러보며 도울 거리를 찾는다. OpenAI가 든 예가 이렇다. 한 프리랜서의 dot이 메일 스레드를 보다가 아직 안 보낸 청구서를 발견했고, 필요한 내용을 모아 초안을 만들었다. 사용자가 승인하자 PDF로 보냈다. 이 "선제 조사" 중에는 읽기 전용이라 메시지를 보내거나 내용을 바꾸지 못한다.

어디까지 혼자 하게 둘지는 내가 정한다

에이전트가 알아서 일한다는 건 알아서 사고를 칠 수도 있다는 뜻이다. 그래서 dots에는 행동 규칙이 있다. 작업 종류마다 네 가지 중 하나를 고른다.

  1. 알아서 한다
  2. 내가 명시적으로 요청할 때만 한다
  3. 하기 전에 먼저 물어본다
  4. 사람에게 넘긴다

여기에 더해 계정에 영향을 주거나 정보를 밖으로 내보내는 행동은 자동 검토를 한 번 거친다. 비밀번호 변경은 규칙과 상관없이 항상 사람이 한다. 로그인할 때 비밀번호는 모델에게 보이지 않는 방식으로 처리된다고 한다. 감시 시스템이 이상하다고 판단하면 dot을 멈추거나 중단시킨다.

누가 쓸 수 있나

  1. Pro와 Business Premium 구독자에게 dot 하나가 포함된다. Free와 Plus는 아직 없다.
  2. Enterprise, Edu, Healthcare는 워크스페이스 관리자가 켜면 베타로 쓸 수 있다.
  3. Pro는 유럽(EEA, 영국, 스위스)에서 쓸 수 없다. Business Premium은 지원 지역 전체에서 된다.
  4. dot과의 대화는 ChatGPT 사용량 한도에 잡히지 않는다. 다만 dot이 Codex나 ChatGPT Work에서 시작한 작업은 잡힌다.
  5. 처음 만드는 건 데스크톱 앱이나 웹 브라우저에서 해야 하고, 그다음부터는 모바일에서도 쓸 수 있다.

기업용으로는 조달, 송장 처리, 고객 지원, 계약 업무 같은 걸 맡는 "전문 dot"도 미리보기로 나왔다. 회사 시스템에 접근하는 자체 계정과 권한을 갖는 형태다.

아직 부족한 점

출시 첫 주 반응은 기대 반, 의심 반이다.

  1. DevDay 라이브 데모에서 첫 dot이 대답을 안 했다. 발표자의 "dot이 오늘 아침 좀 느리네요"가 행사에서 가장 많이 인용된 말이 됐다.
  2. 초기 테스터들은 몇 분씩 멈추는 현상, 권한 오류, 메시지 누락, 브라우저 접속 실패를 보고했다.
  3. 작업 범위가 중간에 말없이 바뀌는 테스트에서, 한 작업의 정보를 다른 작업으로 가져가거나 건드리면 안 되는 문서를 고치는 "범위 위반"이 사이에 낀 작업 수가 늘수록 8.6%에서 19.7%까지 올라갔다.
  4. dot 전용 이메일 주소, 사용자에게 먼저 거는 전화, 기억을 세밀하게 지우는 기능은 아직 없다.

타이밍도 미묘했다. 발표 사흘 전, OpenAI는 자사 에이전트가 ChatGPT 사용자 이미지 53장을 이미지 호스팅 사이트에 잘못 올렸다고 공개했다. "알아서 일하는 에이전트"를 내놓기 직전에 "알아서 사고 친 에이전트" 소식이 나온 셈이다.

정리하며

dots가 새로운 건 모델 성능이 아니라 형태다. 대화창 하나를 열고 닫는 도구에서, 계정과 컴퓨터를 가진 동료에 가까운 무언가로 바뀌었다. 나도 텔레그램으로 맥에서 도는 AI 세션에 일을 시키는 구성을 만들어 쓰고 있는데, 직접 해보면 가장 어려운 건 "어디까지 혼자 하게 둘까"를 정하는 일이다. dots가 행동 규칙을 제품 한가운데 둔 것도 같은 이유일 것이다.

쓸 만한지는 두 가지에 달려 있다고 본다. 데모처럼 멈추지 않고 꾸준히 도는가, 그리고 내가 정한 선을 정말 안 넘는가. 첫 번째는 몇 달이면 나아질 문제고, 두 번째는 훨씬 오래 지켜봐야 할 문제다.

Comments 0

No comments yet. Be the first!

← Back to Blog