snow · 2026.9.10 00:03 · 조회 0

Anthropic 연구원 제이콥 콕슨, "AI 통제불능" 경고하며 퇴사

AIAnthropic제이콥 콕슨Jacob Coxon에반 허빙어Evan HubingerAI 안전성OpenAI초지능

Anthropic의 사전학습(pretraining) 연구원 제이콥 콕슨(Jacob Coxon)이 AI 업계의 경쟁적 개발 경쟁이 통제 불능 상태로 이어질 수 있다고 경고하며 회사를 떠났다. 그는 OpenAI와 Anthropic 모두 자기개선형 초지능(self-improving superintelligence)을 향해 무책임하게 질주하며 "우리의 생명을 걸고 도박하고 있다"고 비판했다. 이 소식은 월스트리트저널(WSJ) 보도를 시작으로 2026년 9월 9일 전후로 확산되며 AI 안전성 논쟁에 다시 불을 지폈다.

배경

콕슨은 OpenAI와 Anthropic에서 약 3년간 사전학습 연구를 담당해온 인물이다. 그는 X(구 트위터)를 통해 "두 회사 모두 책임감 있게 행동하지 않고 있다. 그들은 자기개선형 초지능을 향해 곧장 질주하며 우리의 생명을 걸고 도박하고 있다"는 취지의 글을 남기며 퇴사 사실을 알렸다. 그는 AI 개발자들 사이에서 향후 10년 안에 기술이 인류 전체를 위협할 수 있다는 우려가 경영진과 고위 연구원들 사이에서 공개 발언보다 훨씬 심각하게 비공개적으로 논의되고 있다고 주장했다.

Anthropic의 얼라인먼트 사이언스(Alignment Science) 리드인 에반 허빙어(Evan Hubinger)도 이런 우려에 공개적으로 동조하며, AI가 향후 10년 내 인류를 멸종시킬 확률이 10%를 넘는다는 견해를 밝힌 것으로 전해졌다.

영향

이번 퇴사는 Anthropic이 "안전을 중시하는 AI 기업"이라는 설립 취지를 내세워왔다는 점에서 업계에 파장을 일으키고 있다. 콕슨은 OpenAI에 대해서는 많은 직원이 문명 차원의 위험성을 충분히 인식하지 못하고 있다고 평가한 반면, Anthropic에 대해서는 위험성을 이해하면서도 경쟁에서 먼저 도달하기 위한 압박에 갇혀 있다고 지적했다. 이는 AI 랩들이 안전보다 속도 경쟁을 우선시하고 있다는 외부의 비판과 궤를 같이한다.

향후 전망

콕슨은 주요 AI 연구소 간 협조를 강화하고, 모델 능력 개선에 대한 임시 중단(모라토리엄) 가능성을 검토해야 하며, 이러한 결정을 민간 기업의 내부 채널이 아닌 곳에서 내려야 한다고 제안했다. 앞으로 Anthropic과 OpenAI가 안전성 관련 내부 우려에 어떻게 대응하는지, 그리고 이번 사안이 AI 안전 규제 논의에 어떤 영향을 미칠지 주목할 필요가 있다.

자주 묻는 질문

Q. 제이콥 콕슨은 누구인가요? A. Anthropic에서 사전학습 연구를 담당했던 연구원으로, OpenAI와 Anthropic에서 약 3년간 AI 모델 개발에 참여한 뒤 AI 산업의 무분별한 경쟁을 경고하며 퇴사했다.

Q. 그는 왜 퇴사했나요? A. OpenAI와 Anthropic이 자기개선형 초지능을 향해 안전 장치 없이 경쟁적으로 질주하고 있으며, 이것이 인류에게 통제 불능 수준의 위험을 초래할 수 있다고 판단했기 때문이다.

Q. Anthropic은 이 주장에 어떻게 대응했나요? A. 공개적으로 확인된 별도의 공식 반박은 보도되지 않았으며, 오히려 Anthropic의 얼라인먼트 사이언스 리드인 에반 허빙어가 비슷한 위험 인식에 동조하는 입장을 밝힌 것으로 전해졌다.

출처 - https://news.google.com/rss/articles/CBMilwFBVV95cUxNNkJNMUhyUzQ3M1FsRFZMcUhKMGFFeFpsdnJaVzM4T2duWVVFYTk4ZUpXN0dRemFMUjZ3bC1CZ29ETjF4dWlScEQ5UVZDYVhLOUt0YVVmV1JfdjVoZWVpcXVyTFhDdjNTN0NIc2h6bXdRbkZDek5RX3poR0JkRE5XdG55ZFFJRGNqRWllSzllQk56LWJHYURn?oc=5

댓글

아직 댓글이 없습니다.

댓글을 작성하려면 로그인이 필요합니다.