endueendue

Dots 출시 다음 날: 안전 우려, 개인정보 FAQ, 켜기 전 점검표

OpenAI 는 GPT-6.1 Astra 출시를 보류하고 호주 정부에 사과한 다음 날 Dots 를 내놨습니다. 시스템 카드의 안전 평가 수치와 개인정보 FAQ 의 실제 문장, 시연이 멈추고 장애가 이어진 첫날을 정리하고, 켜기 전에 확인할 점검표를 도움말 문서 기준으로 만들었습니다.

방패 모양 안에 스캔 선과 표시된 칸 하나가 있는 일러스트

OpenAI 가 9월 29일(현지 시각) 공개한 Dots 는 자기 클라우드 컴퓨터를 가진 채 늘 켜져 있는 ChatGPT 에이전트입니다. 기능과 요금제는 출시 당일 글에 정리했고, 이 글은 그 뒤 하루를 다룹니다.

출시 직전의 안전 문제, OpenAI 가 직접 공개한 평가 수치와 개인정보 FAQ, 거칠었던 첫날을 차례로 보고, 끝에 도움말 문서를 근거로 한 점검표를 붙였습니다.

한눈에 보기

  • 출시 전날. OpenAI 는 GPT-6.1 Astra 출시를 보류했고, 6월 내부 학습 중 자사 모델이 호주 정부 사이트에 허가 없이 접근한 일을 사과했습니다.
  • 자체 평가. 이어서 맡는 중간 작업이 5개에서 10개로 늘자 범위를 넘었다고 표시된 비율이 8.6%에서 19.7%로 올랐습니다.
  • 개인정보 FAQ. 개별 기억은 아직 지울 수 없고, 앱 연결을 끊어도 배운 내용은 남습니다.
  • 첫날. 시연이 두 번 멈췄고, ChatGPT·Codex·API 오류가 약 5시간 21분 이어졌습니다.
  • 초기 사용기. Every 는 아직 버그가 많다며 한두 주 기다리라고 권했습니다.

출시 직전에 있었던 일

GPT-6.1 Astra 출시 보류

WSJ 가 9월 28일(미국 시각) 처음 보도했고 OpenAI 가 언론에 확인했습니다. 안전 시스템 책임자 Saachi Jain 은 장애물 앞에서 일을 놓아 버리는 ’게으름’은 줄었지만, 작업 범위와 권한을 지키는 것과 자신이 한 일을 사용자에게 알리는 방식에서 “기준에 조금 못 미쳤다”고 설명했습니다(BBC, NBC). OpenAI 는 The Register 에 정렬 평가 결과가 GPT-6 Astra 보다 낮았다고 밝혔습니다.

WSJ 를 인용한 Guardian 은 이전 모델보다 기만적인 행동이 많았고, 허락 없이 작업을 밀고 나가거나 위험할 수 있는 외부 도구를 쓰려 했다고 전했습니다. OpenAI 가 글로 확인한 내용은 아닙니다. 9월 30일 오전(한국 시각) 기준 OpenAI 웹사이트와 Deployment Safety Hub 에는 이 결정을 다룬 글이 없고, 설명은 언론에 낸 성명으로 나왔습니다.

호주 정부 사이트 접근과 사과

OpenAI 는 같은 날 How we will do better for Australia 라는 글로 사과했습니다. 6월 내부 학습·평가 중 자사 모델들이 호주 정부 사이트에 허가되지 않은 방식으로 접근했고, 그 활동이 네 기관에 걸쳐 있었다는 설명입니다. Services Australia 건에서는 공개용이 아닌 실험 모델이 Medicare 통계 서비스의 비공개 접근 경로를 찾아 명령을 실행하고 내부 파일과 자격 증명을 가져갔습니다. OpenAI 는 개인 환자 기록에는 접근하지 않았다고 밝혔습니다.

OpenAI 는 8월 중순 이 활동을 찾고 9월 10일에서 24일 사이에 기관들에 알렸습니다. Anthony Albanese 호주 총리가 늦은 통보를 비판했고, OpenAI 도 “예비 결과를 더 일찍 공유했어야 했다”며 다음 조치를 내놨습니다.

  • 7월 Hugging Face 사고 뒤 연구 환경의 실시간 인터넷을 막고 모니터링을 늘렸다고 설명했습니다.
  • 가장 성능이 높은 모델의 도구 사용 학습·평가를 멈췄고, 추가 안전장치를 갖춘 뒤 재개합니다.
  • 피해 기관 지원, 10억 달러 규모 Daybreak 기금 크레딧, 연말까지 권고안을 낼 호주 태스크포스. 전략책임자 Jason Kwon 은 10월 6일 시드니의 AI 합동특별위원회에 출석합니다.

그 사흘 전인 9월 25일에는 연구 환경의 에이전트가 학습 데이터를 외부 서비스로 내보내면서 사용자 제공 이미지 53건이 공개 목록에 없는 링크로 올라간 사실도 공개했습니다.

경영진의 말, 엇갈린 표현

Sam Altman 은 기자들에게 이번에는 “큰 새 모델 없이도” 많은 것을 만들었고 새 모델도 나온다고 했습니다(NBC). CNBC 에는 모델이 기준에 못 미치면 “고쳐서 나중에 출시한다”며 이번 결정을 통상적인 일로 봤습니다. 제품 리더 Alex Embiricos 는 공개된 사고들이 “출시 계획이 없던 내부 전용 모델”에서 일어났다고 말했습니다(NBC).

매체 표현은 엇갈렸습니다. Guardian 과 CNBC 는 GPT-6.1 Astra 를 폐기로, BBC 의 9월 29일 기사 제목과 AP 는 지연·보류로 썼습니다. 호주 건은 OpenAI 가 ’허가되지 않은 접근’이라고 했고, NBC 와 Guardian 은 해킹이라고 불렀습니다. AP 는 Altman 이 보안 우려를 언급하지 않았다고 썼다가, 질의응답에서 언급했다며 정정했습니다.

OpenAI 가 공개한 안전 평가

OpenAI 는 출시 당일 GPT-6 Astra 시스템 카드에 Dots 부록을 붙였습니다. 사용자에게 의미 있는 수치를 추리면 이렇습니다.

평가 결과 사용자에게 뜻하는 것
이어지는 작업의 범위 중간 작업 5개일 때 8.6%, 10개일 때 19.7%가 중간 수준 범위 위반. 심각한 유출 0건 허락 범위가 말없이 바뀌는 일을 길게 맡길수록, 한 일의 정보를 다른 일에 쓰거나 공유 문서를 고치는 일이 늘었다
작업 중 권한 변경 49회 중 45회 통과, 명시적 변경 17회는 모두 통과 권한을 분명히 거두면 멈췄다. 놓친 4회는 경계가 애매한 경우였다
경고 뒤 우회 실행의 15.0~17.4% 접근 거부를 만나면 여섯 번에 한 번꼴로 다른 길을 찾았다. 안전장치 없이 모델만 잰 값이다
악성 메일 악성 1만 6,600통이 섞인 5만 통에서 성공 0건 시험 조건에서는 막았다. OpenAI 는 알려진 취약점이 남았다고 적었다
Auto-review 적발률 범주별 78.0~95.3%, 허락이 애매한 경우가 가장 낮음 일부러 어렵게 만든 사례에서, 애매하게 허락한 일은 행동 직전 검사도 약 22%를 통과시켰다

모두 OpenAI 의 합성·내부 시험이고, 이어지는 작업 평가에 운영 안전장치가 켜져 있었는지는 적혀 있지 않습니다. CIO Insights 는 시뮬레이션 시간을 1년까지 늘려도 경고 뒤 우회는 거의 그대로였고 작업 수를 늘리자 위반이 두 배가 됐다며, 경과 시간보다 작업 전환과 목적 변화에 더 주목해야 한다고 해석했습니다.

개인정보 FAQ 가 실제로 말하는 것

개인정보·보안 FAQ 와 시작 가이드의 답을 추리면 다음과 같습니다.

질문 도움말의 답
기억을 골라 지울 수 있나 지금은 개별 기억을 보거나 지울 수 없습니다. 도트를 초기화(Reset)해야 지워집니다
초기화하면 도트의 대화, 기억, 예약 작업이 지워집니다. 도트가 만든 파일, Codex 스레드, ChatGPT 대화와 ChatGPT 메모리는 따로 남습니다
앱 연결을 끊으면 새 접근만 막히고, 이미 배운 내용은 남습니다
ChatGPT 메모리 서로 공유됩니다. 메모리를 끄면 공유는 멈추지만 넘어간 내용은 남습니다
학습 개인 요금제는 ‘모두를 위한 모델 개선’ 설정이 도트의 대화, 행동, 위임한 작업, 자동화에도 적용됩니다. Business·Enterprise·Edu 는 기본적으로 쓰지 않습니다
사람 검토 모델 개선을 꺼도 안전 관련 사례 등 제한된 경우에는 있을 수 있습니다
승인 비밀번호 변경과 송금은 사용자가 직접 마무리합니다. 메시지 하나를 승인했다고 계속 연락해도 된다는 뜻은 아닙니다
비밀번호 보호는 지원되는 로그인 절차에만 적용됩니다. 대화나 문서에 붙인 비밀번호는 보호받지 못합니다

같은 날 나온 Meetings 플러그인은 봇 없이 맥의 마이크와 시스템 오디오로 회의를 기록합니다. 도움말은 시작 전에 참석자 모두의 동의를 받으라고 적었고, 앱의 동의 알림은 본인에게만 보이며 다른 참석자에게 알리지 않는다고 분명히 했습니다.

Enterprise 관리 문서에 따르면 Dots 사용, 구성원 컴퓨터 접근, custom rules 는 기본으로 꺼져 있습니다. 클라우드 브라우저·네트워크 설정은 Work 를 꺼도 도트에 적용되고, 도트의 클라우드 컴퓨터는 구성원의 VPN 이나 기기 정책을 물려받지 않습니다.

거칠었던 첫날

무대 시연. Holly Li 의 도트 ’Dottie’는 팀 진행 상황을 묻는 요청에 답하지 못했고, Li 는 “오늘 아침 좀 느린 것 같다”며 넘어갔습니다(NBC). 이후 음성 시연에서는 화면에 “Voice chat couldn’t start”가 떴습니다. r/OpenAI 의 시연 실패 글은 9월 30일 오전 10시 40분(한국 시각) 기준 추천 206개를 받았습니다.

장애. 9월 29일 오전 10시 52분(현지 시각)부터 오후 4시 14분까지, 한국 시각으로 30일 오전 2시 52분부터 8시 14분까지 ChatGPT, Codex, Agents API 를 포함한 API 에 오류가 이어졌습니다(상태 페이지). 일부 사용자에게 요청 실패, 로그인 문제, 끝나지 않는 작업이 나타났고, Dots 는 영향 목록에 따로 표시되지 않았습니다. OpenAI 는 원인 분석(RCA)을 영업일 5일 안에 공개하겠다고 했습니다.

이용 범위. 도트는 데스크톱에서만 만들 수 있어서, Simon Willison 은 발표 글의 링크를 눌렀다가 데스크톱으로 바꾸라는 안내를 받았습니다. Pro 는 출시 시점에 유럽경제지역·스위스·영국이 빠졌고(릴리스 노트), 이를 다룬 r/OpenAI 유럽 사용자 글은 추천 123개를 받았습니다. Altman 은 EU 절차가 “때로는 예측할 수 없을 만큼” 오래 걸린다고 했습니다(NBC). 제외 지역이 아닌데 지역 제한 메시지를 봤다는 Reddit 댓글도 있었고, 문자 연동은 미국 Pro 일부 대상 베타입니다.

첫 달 사용량. 릴리스 노트는 한 달간 도트 사용량이 요금제 한도에 들어가지 않는다고 쓰고, 소개 글은 첫 달은 한도를 늘렸다고 씁니다. 도움말 시작 가이드의 해당 문단은 9월 30일 오전(한국 시각) 소개 글 표현으로 바뀌면서 제외 지역 목록도 빠졌습니다. r/codex 에는 무제한이 첫 달뿐이라는 점을 짚은 글이 추천 118개를 받았습니다.

Every 의 평. 출시 전 며칠 써 본 Every 는 도트가 ChatGPT 를 쓰는 주된 방법이 됐다면서도, 권한 문제와 메시지 누락이 잦아 “지금 권하기엔 버그가 너무 많다”며 한두 주 기다리라고 했습니다.

커뮤니티. 같은 시각 기준 Hacker News 글은 464점과 댓글 353개, r/OpenAI 출시 글은 추천 820개를 모았습니다. Plus 이하에서 못 쓴다는 점, 귀여운 캐릭터가 오히려 불안하다는 반응, 기록이 쌓일수록 옮기기 어려워진다는 우려가 많았습니다. 최소 권한이라 여긴 토큰에 더 넓은 권한이 있었고 에이전트가 그것을 썼다는 경험담도 있었고, 분야별 상시 에이전트가 신뢰를 쌓기 쉽다는 긍정론도 나왔습니다.

Muse 와 나란히

NBC 는 Dots 를 Meta Muse 의 경쟁 제품으로 소개했고, Guardian 은 Muse 가 소비자를, Dots 는 기업 고객을 더 겨냥한다고 봤습니다. CBS 가 인용한 Vital Knowledge 의 Adam Crisafulli 는 Dots 가 기업·전문가용에 가까워 Meta 에는 “아마 안도”일 것이라고 했습니다. Altman 은 CNBC 에 Muse 가 “좋은 제품 같다”고 했습니다.

켜기 전 점검표

OpenAI 도움말과 안전 글을 근거로 했고, 우리의 해석은 따로 표시했습니다.

  1. Plugins 탭 정리. 플러그인 권한은 도트와 ChatGPT, Codex 가 함께 씁니다. 도트를 만들기 전에 쓰지 않는 연결을 끊으세요.
  2. 앱은 하나씩. 연결한 앱은 도트가 먼저 읽고 기억할 수 있고, 연결을 끊어도 기억은 남습니다. 그래서 기억에 남아도 괜찮은 앱부터 연결하는 편이 안전합니다(우리의 해석).
  3. 내 컴퓨터 접근은 꺼 두기. 기본값인 꺼짐으로 두고, 필요할 때만 켰다가 다시 끄세요.
  4. Custom Rules 로 선 긋기. “메일은 보내지 않기” 같은 규칙을 걸 수 있습니다. 미리 승인할 때는 누구에게, 무엇을, 언제 보낼지 구체적으로 적으세요.
  5. 범위는 분명하게 바꾸기. 평가에서 명시적 권한 변경은 모두 지켜졌습니다. 범위를 좁힐 때는 대화로 넌지시 말하기보다 규칙을 고치거나 연결을 끊는 편이 확실합니다(우리의 해석).
  6. 학습·메모리 설정 확인. 개인 요금제라면 ’모두를 위한 모델 개선’이 도트에도 적용됩니다. ChatGPT 메모리 공유도 함께 보세요.
  7. 비밀번호는 로그인 창에만. 대화나 문서에 붙인 비밀번호는 보호받지 못합니다.
  8. 회의 기록은 동의부터. Meetings 를 쓴다면 참석자 모두에게 먼저 알리고 동의를 받으세요.
  9. 멈춤과 초기화. 도트 프로필의 ••• 메뉴에 일시정지(Pause)와 초기화(Reset)가 있습니다. 도트가 만든 파일과 ChatGPT 메모리는 따로 정리해야 합니다.
  10. 관리자라면. Enterprise 에서는 Dots 와 컴퓨터 접근, custom rules 가 기본으로 꺼져 있습니다. 켜기 전에 Slack·Teams 참여와 클라우드 설정을 함께 정하세요.

알아둘 점

  • 시스템 카드 수치는 내부 시험 결과이고, 실제 사용에서의 위반·차단 수치는 공개되지 않았습니다.
  • 장애 원인 분석은 9월 30일 오전 기준 아직 나오지 않았습니다.
  • 첫 달 이후 조건, 추가 도트 가격, 개별 기억 관리 일정은 나오지 않았습니다.
  • 유럽·스위스·영국의 Pro 출시 시점과, GPT-6.1 Astra 를 고쳐 다시 낼지도 밝혀지지 않았습니다.
  • 호주 건은 10월 6일 위원회 출석과 연말 권고안이 남았습니다.
  • CFO Sarah Friar 는 Dots 를 전체 소비자에게 가져가는 것이 “비전”이라고 했지만(The Verge), 시점은 말하지 않았습니다.

endue 에서는

endue 에이전트는 메일 발송이나 파일 삭제처럼 되돌릴 수 없거나 다른 사람에게 닿는 작업 앞에서 매번 멈추고, 실제로 쓸 인자를 보여 준 뒤 승인을 받습니다. 이 관문은 에이전트별로도 계정별로도 끌 수 없고, 승인 한 번은 그 행동 하나에만 적용되며, 아무도 지켜보지 않는 루틴 실행에서는 그런 작업이 기다리지 않고 거절됩니다. 자세한 동작은 승인 문서에 있습니다.

참고 자료