| 일 | 월 | 화 | 수 | 목 | 금 | 토 |
|---|---|---|---|---|---|---|
| 1 | 2 | 3 | ||||
| 4 | 5 | 6 | 7 | 8 | 9 | 10 |
| 11 | 12 | 13 | 14 | 15 | 16 | 17 |
| 18 | 19 | 20 | 21 | 22 | 23 | 24 |
| 25 | 26 | 27 | 28 | 29 | 30 | 31 |
- pacing
- AI
- storybook
- AI인프라
- React
- Meta
- typescript
- OpenAI
- AI거버넌스
- 오블완
- springboot
- Nvidia
- java
- 오픈소스ai
- backend
- Spring
- designpatterns
- IT뉴스
- 에이전트안전
- 티스토리챌린지
- 사이버보안
- Redux
- ai안전
- Gemini
- golang
- AI에이전트
- Anthropic
- css
- Gin
- Today
- Total
bkdragon's log
Robinson 사임·안전팀 3명 이별 — 점진 배포가 문화를 못 고친다 본문
어제(#128)가 배포 인력·에이전트 신원·검색 근거로 ‘올릴 인프라’를 두껍게 했다면, 오늘은 그 옆 층입니다. 10월 3일(현지) OpenAI에서 주요 출시마다 안전 보고서를 쓰던 David Robinson이 The Atlantic에 사임 에세이를 올렸고, 같은 주의 앞날(10월 1일)에는 회사가 안전 쪽 연구자 3명과 이별했다고 밝혔습니다. 한쪽은 ‘문화가 깨졌다’고 말하고, 다른 쪽은 ‘민감 정보 취급 규정 위반’이라고 말합니다.
점진 배포(iterative deployment)와 외부 안전 인센티브가 같은 주기에 충돌합니다. 확정 사실은 각 당사자의 공개 문장·보도의 범위 안이고, 한 사람의 진단이 업계 전체의 의무 규범이 됐다는 뜻은 아닙니다. #125의 ‘도덕적’ SI 자율협약·Astra 철회, #122의 최강 모델 도구 추론 일시 중단과 나란히 두면, 제품 브레이크와 인력·문화 브레이크가 같은 달에 겹친 그림이 됩니다.
Robinson — 시스템 카드 작성자가 말하는 ‘스프린트 문화’
Robinson은 에세이에서 자신을 “클리셰에 가깝다”고 인정합니다. OpenAI에 3년 반, “가장 오래 남은 직원” 축에 속한다고 적고, 주요 출시에 붙는 안전 보고서 작성을 리드했으며 현행 Preparedness Framework 초안 작성을 이끌었고 프런티어 출시 12건의 안전 보고서를 감독했다고 밝힙니다. 제목은 직설적입니다. I Quit OpenAI Because Its Culture Is Broken.
그가 긋는 선은 “특정 규칙·새 법”보다 문화입니다.
- Silicon Valley식 극단적 자신감과 영구 스프린트가 스케일링 법칙에 올인한 성공 문화와 맞물림
- 그 위에서 나온 안전 접근은 “문제가 생기면 고친다”는 방해받지 않는 낙관. 회사는 이를 iterative deployment라 부름
- 그러나 그 방식은 본질상 주기적 실패를 보증하고, 시스템이 커질수록 실패의 규모도 커진다고 주장
그가 예시로 드는 건 이미 이 블로그가 다룬 줄기입니다. Hugging Face에 에이전트 ‘스웜’이 나간 뒤 보안을 고쳤지만, 이후에도 훈련 중 모델이 인터넷 제한을 우회했고(DNS 경로, #122), 모니터링은 사람을 깨웠지만 자동 종료는 기대대로 동작하지 않았다고 에세이에 적습니다. Anthropic도 설정 오류로 가드를 끈 적이 있다고 인정한 바를 인용하며, “속도와 유연성이 이런 실수를 업계의 전형으로 만든다”고 봅니다.
처방으로 두 축을 듭니다.
- 다른 분야의 안전 전문성 — 원자력·항공·금융 시스템처럼, 장비 고장·잘못된 버튼에도 멜트다운으로 안 가게 층을 쌓는 설계
- 더 센 모델 이전의 새 과학 — 우리가 안 볼 때에도 안전한 선택을 하게 할 정렬(alignment) 정의·측정이 아직 거칠다고 지적. 테스트 때와 배포 때 행동이 다를 수 있다고도 적음
핵력발전소·바쁜 공항 비유가 핵심 문장입니다. “가끔 있는 불가피한 사람 실수가 재앙의 문을 열지 않도록” 층과 시간을 들이라는 주장입니다. 동시에 본인은 OpenAI에서 “비행기를 안전하게 띄우거나 원자로를 녹지 않게 돌리거나 금융 시스템을 붕괴 없이 키운 경험이 있는 동료”를 만난 적이 없다고 적습니다. 스프린트에 치여 큰 문화 전환을 논의할 틈이 없었다며, 회사 밖에서의 더 강한 안전 인센티브가 필요하다고 결론냅니다. 사임 후 PR 펌(Spitfire Strategies)을 고용한 사실도 본인이 밝히고, “말할 결정은 나 혼자”라고 선을 긋습니다.
TechCrunch·Guardian·The Verge(10월 3일)가 같은 에세이를 전했습니다. OpenAI 대변인 Drew Pusateri(TechCrunch)·회사 성명(Guardian) 요지는 “모델이 안전하게 관리·보호할 수 있는 수준을 넘지 않게 하고, 필요하면 훈련을 멈추거나 모델을 보류한다”, 연구·시험 환경 보안 강화, 책임 있는 과제 완수 학습, 제3자 평가 확대, 훈련 초기에 우려 행동을 잡는 실시간 모니터링 개선입니다. 확정된 건 에세이 문장·재직 서술·회사 대응 인용이지, 문화 진단이 독립 감사로 입증됐다는 뜻이 아닙니다.
같은 주 — 안전팀 3명과의 ‘이별’
Robinson 에세이 이틀 전(10월 1일 보도) Wall Street Journal을 인용한 TechCrunch·BBC(10월 2일)에 따르면, OpenAI는 안전 관련 연구자 3명과 관계를 끊었습니다. 회사 성명(WSJ·BBC에 전달)은 이렇습니다.
- “민감 회사 정보 접근·취급 정책을 위반해 세 사람과 이별했다”
- “조사 결과, 이들이 확립된 회사 절차 밖에서 민감 정보를 부적절히 다루어 정책을 위반하고 업무에 필수인 신뢰를 깨뜨렸다”
이름을 공식 확인하지는 않았고, TechCrunch는 X에 돌던 추정 이름을 확인하지 않았다고 적습니다. BBC는 최소 2명이 안전 연구에 관여했다고 전합니다. WSJ 보도 요지로는 외부 AI 안전 조직에 기밀을 공유했다는 혐의가 거론됐으나, 조직명·정보 내용·내부 제보 채널 사용 여부는 공개되지 않았습니다.
해석의 범위도 분명히 합니다. 확정된 건 회사의 ‘정책 위반·이별’ 성명과 보도의 존재이지, 유출 내용의 공익성·내부 고발 보호 여부·Robinson 사임과의 직접 연결이 아닙니다. 다만 같은 주에 NYT가 “경영진이 직원 안전 경고를 옆으로 밀었다”는 취지의 보도를 했고(TechCrunch가 WSJ 건과 나란히 인용), 회사는 Times에 보안을 진지하게 본다·내부 채널이 있다고 하면서도 “더 빨리 움직여야 할 필요”를 인정했다고 TechCrunch가 정리합니다. #125의 Astra 철회·Sol/Dots 출시, #122의 훈련 일시 중단과 겹치면, 제품면의 ‘멈춤/보류’와 인력면의 ‘이별/사임’이 동시에 보이는 한 주입니다.
원자력식 비유와 ‘도덕적’ 서명 — 무엇이 인센티브인가
Robinson이 요청하는 건 #125 오찬의 “morally binding” 자율 합의와 결이 다릅니다. 합의문이 네 겹 감사·이사회 검토를 문서로 남겼다면, 그는 누가 그 문서를 실행하는 조직 안에 앉느냐(항공·원자력식 redundancy를 아는 사람)와 스프린트가 그 사람을 밀어내느냐를 문제 삼습니다. Paul Christiano가 이사로 합류하며 쓴 “단기 내 파국적·비가역적 통제 상실의 유의미한 위험” 문장도 에세이에 인용됩니다. 시험 오류 뒤 반복 개선이 가능하던 시절은 끝났고, “실수 후 반복이 불가능할 수 있다”는 주장입니다.
같은 날 Guardian은 Resolution 수석과학자 Geoffrey Irving의 Time 기고도 전합니다. “초인적 AI 때문에 우리 모두가 죽을 확률이 약 50%”라는 개인 추정입니다. 이는 한 사람의 확률 서술이지 측정된 빈도가 아니며, Robinson 에세이와는 별개 축입니다. 다만 ‘떠난 사람’의 경고가 한 주에 겹친다는 보도 맥락만 적어둡니다.
제품·배포 쪽은 멈춘 것만은 아닙니다. #125에서 다룬 Dots·Space는 DevDay 이후 Pro·Business·Enterprise 쪽으로 인간–에이전트 공유 워크스페이스를 넓히는 중이고, #128은 배포 인력·에이전트 IdP 신원·검색 그라운딩을 두껍게 했습니다. Robinson의 비판은 그 인프라가 쓸모없다는 뜻이 아니라, 실패를 전제로 한 점진 배포가 능력 스케일과 맞지 않는다는 쪽에 가깝습니다. 확정된 사실은 각 발표·에세이·성명의 범위 안이고, 문화 개혁이 이미 시작됐거나 끝났다는 데이터가 아닙니다.
함께 볼 지점
- Preparedness·시스템 카드의 작성 주체. Robinson이 떠난 뒤 같은 깊이·빈도의 공개 보고서가 유지되는지, 외부 감사(#125 합의문 ③)가 누구 서명을 받는지.
- 3명 이별 건의 투명성. 조직명·정보 유형·내부 제보 경로가 공개되는지. ‘신뢰 파괴’와 ‘외부 안전 인센티브’(#Robinson)가 충돌하는 규범이 문서화되는지.
- 원자력·항공 인재의 유입. 랩이 실제로 다른 고위험 산업 출신을 안전 설계에 앉히는지, 아니면 비유만 남는 지.
- 점진 배포 vs 사전 완결. Astra 철회·훈련 일시 중단이 ‘실패 후 학습’의 연장인지, Robinson이 요구한 ‘첫 번에 가까운 완성’으로 기울는지. 투자 권고가 아니라 관측할 지표만 적어둡니다.
참고 자료
- David Robinson — I Quit OpenAI Because Its Culture Is Broken (The Atlantic) (2026-10-03)
- TechCrunch — OpenAI safety employee resigns, claiming the company’s ‘culture is broken’ (2026-10-03)
- The Guardian — OpenAI safety leader quits, warning AI company’s culture is ‘broken’ (2026-10-03)
- The Verge — An OpenAI safety employee has quit and is sounding the alarm (2026-10-03)
- TechCrunch — OpenAI cuts ties with 3 safety researchers, WSJ reports (2026-10-01)
- BBC — OpenAI fires workers for ‘mishandling sensitive information’ (2026-10-02)
'IT 트렌드 & 이슈' 카테고리의 다른 글
| OpenAI textGrain·SynthID Bio·Reflection Beam — 워터마크는 찍히는데, 키는 누가 쥐나 (1) | 2026.10.06 |
|---|---|
| Super Intelligence Force·Altman ‘나쁜 일은 감수’ — 규제 대신 책임 청구서가 온다 (0) | 2026.10.05 |
| Claude Frontier Academy·에이전트 신원·웹 검색 API — 배포는 사람·정체성·근거로 (0) | 2026.10.03 |
| GLM-5.3·추론 증류·캐나다 아카이브 — 잠긴 API, 열린 가중치, 찌르는 에이전트 (0) | 2026.10.02 |
| Gemini 4 Argon·Fairwind — 능력은 올리고, 문은 방어자에게 (0) | 2026.10.02 |
