AI 안전 논의의 뿌리는 사실 '섹스 컬트'라는 주장
이 글은 AI 안전(AI Safety) 운동의 지적 중심이 엘리저 유드코프스키(Eliezer Yudkowsky)와 그가 창시한 소위 '섹스 컬트'적 커뮤니티에서 비롯되었다고 주장합니다. 저자는 유드코프스키가 DeepMind 창업 자금 연결, OpenAI 창설 계기, 'AI 얼라인먼트(AI Alignment)' 용어 대중화 등 AI 업계의 핵심 흐름에 깊이 개입했으며, 효과적 이타주의(Effective Altruism)와 합리주의(rationalism) 커뮤니티가 사실상 동일하다고 지적합니다. 나아가 이런 인물들이 AI 정책 수립에 관여해서는 안 된다고 비판합니다.
돌아왔습니다, 여러분이 그리웠어요. 제가 너무 잘 아는 중요한 주제이기에, 'AI 안전은 대부분 섹스 컬트다'를 설명하는 스레드를 준비했습니다. 저는 이 사람들이 정책을 만들어서는 안 된다고 생각합니다. (1/?)
(대체 제목: 컬트 이론 좀 해볼 시간)
수년에 걸쳐 AI 안전 논의와 정책을 그 기원이자 지적 중심으로부터 분리하려는 대대적인 노력이 있었습니다. 왜냐하면 그 중심은 팬픽션 작가가 시작한 섹스 컬트이기 때문입니다. 진지하게 대우받으려면 그 사실을 숨겨야 하죠.
이 사람이 엘리저 유드코프스키("Yud")입니다. 그는 버니 샌더스를 만나 AI 정책에 대해 자문했고, 현재 넷플릭스에 있는 AI 다큐에서 AI 정책을 놓고 논쟁하는 모습을 볼 수 있습니다.
이 사람은 OpenAI의 최고위급 직원이자 비공식 대변인인 Roon입니다. Roon이 유드에 대해 갖는 견해는 1) 그가 섹스 컬트에 속해 있거나 운영하고 있다는 것, 2) 그럼에도 그의 AI에 대한 의견은 매우 중요하고 진지하게 받아들여야 한다는 것입니다.
유드는 셰인 레그와 데미스 허사비스를 피터 틸에게 연결해줘 현재 구글의 AI 연구 부서가 된 DeepMind의 창업 자금을 확보하게 한 인물입니다.
샘 알트먼이 유드에 대해 갖는 견해는 이렇습니다.
이것은 2015년 1월 푸에르토리코에서 열린 Future of Life Institute의 AI 컨퍼런스 일정입니다. 일론 머스크는 그해 12월 OpenAI를 창립했습니다. 유드코프스키는 이 컨퍼런스에서 벌어진 일들이 그 계기가 되었다고 주장하며 그에 대해 분노해 있지만, 이는 사실처럼 보이지 않습니다.
현재 Anthropic의 CEO인 다리오 아모데이는 2013년에 유드의 비영리단체 블로그에서 '효과적 이타주의 커뮤니티의 일원'으로 소개된 모습이 여기 있습니다. 그는 유드와 '클립 최대화자(paperclip maximizer)'에 대해 논쟁을 벌였습니다. Anthropic 논문들은 지금도 가끔 유드를 인용하며, 우리가 AI에 대해 이야기하는 방식 전체가 그의 비영리단체가 대중화한 어휘를 사용합니다.
'AI 얼라인먼트(AI Alignment)'라는 표현은 이렇게 일관되게 사용한 최초의 장이었던 유드코프스키의 비영리단체가 대중화한 것입니다. 유드의 사상이나 래트/EA(rationalist/Effective Altruism) 씬을 암묵적으로 거스르지 않고서는 AI를 논하기가 매우 어렵습니다.
최근 Anthropic을 떠나 내부고발자로 자리매김한 콕슨이 스크린샷에 찍혀 있습니다.
이 부분을 거의 잊을 뻔했네요: 여기 2023년 타임지에서 자신의 취미 주제를 위해 핵전쟁 위험을 감수하자고 주장하는 엘리저 유드코프스키가 있습니다. 샘 알트먼의 집에 화염병 투척을 시도한 남자는 유드코프스키를 주요 영감의 원천으로 언급했습니다. 이에 대해 이야기하는 녹음이 어딘가에 굴러다니니 관심 있는 사람이 있으면 말씀하세요. 하지만 현실적으로 생각해보면, 누가 감히 서툴게 샘 알트먼의 집에 화염병을 던지겠습니까?
'섹스 컬트' 부분으로 반드시 돌아오겠다고 약속합니다. 사실 이건 설명하기 가장 쉬운 부분입니다. 그들이 이에 대해 끊임없이 게시하거든요. 어려운 것은 이것이 본질이라는 사실을 부정하는 방대하고 복잡하며 자금이 충분한 장벽을 넘는 것입니다.
이 그림은 사실 농담이 아닙니다. 유드코프스키의 추종자들은 요즘 자신들을 '합리성 커뮤니티'라고 부르고, 외부에서는 그들을 '합리주의자(rationalists)'라 부르며 그 추종자들을 '합리주의(rationalism)'라 합니다. 아마도 이렇게 부르면 덜 컬트처럼 들린다고 생각하는 모양입니다. 저는 개인적으로 그 매우 긴 '우리는 종교가 아닙니다 설명'이 우습기도 하고 모욕적이기도 합니다.
아, 이 수표도 현금화해 두겠습니다: 수천 개의 컬트를 낳은 팬픽션은 '해리 포터와 이성주의의 방법(Harry Potter and the Methods of Rationality)'입니다. 이것은 현대의 단일 종교 텍스트로는 아마 가장 큰 영향력을 가진 것이며, 그 영향력이 아직 정점에 이르지 않았을 수 있습니다.
웃긴 연표입니다.
(en.wikipedia.org - 해리 포터와 이성주의의 방법 - 위키피디아)
소문에 따르면 '효과적 이타주의(Effective Altruism)'는 별개의 것이며 유드에게 지시를 받지 않는다고 합니다. 이것은 기본적으로 헛소리입니다. 사상과 사람이 크게 겹치는데, 특히 샌프란시스코에서는 더욱 그렇습니다. 또한 Anthropic은 효과적 이타주의 기업이 아니라고 들었습니다. 이것은 100% 헛소리입니다.
버니와 유드가 나온 그 영상? 그 방에 함께 있던 사람들: 제프리 라디시(Palisade Research, Coefficient 지원)와 다니엘 코코타일로(AI 2027 저자, Survival and Flourishing Fund 지원). 모두 '합리주의자'가 아닌 '효과적 이타주의자'들이지만, 그들 모두 이 씬에 끼어 있었습니다.