구글 딥마인드, AGI 논의 확대 위한 '딥마인드 인스티튜트' 출범
구글과 구글 딥마인드 연구자들이 AGI(범용 인공지능) 관련 논의를 확대하기 위해 '딥마인드 인스티튜트'를 출범시켰다. 데미스 해사비스 등이 이사진으로 참여하며, 첫 성과물로 AGI 경제정책, AI 모델 투명성, 미국 주도 프런티어 AI 표준 기구 제안 등 4편의 에세이를 발표했다. 특히 해사비스는 자발적 검토에서 시작해 점차 의무화하는 프런티어 AI 평가 체계와 상황 심각 시 조율된 개발 속도 저하까지 포함한 프레임워크를 제안해 주목된다.
구글과 구글 딥마인드 연구자들이 수요일, 범용 인공지능(AGI)에 관한 논의를 진전시키기 위해 '딥마인드 인스티튜트(DeepMind Institute)'를 출범시켰다. 이 인스티튜트는 딥마인드 공동 창업자인 셰인 레그(Shane Legg), 구글 임원 제임스 매니카(James Manyika), 구글 딥마인드 회장 데미스 해사비스(Demis Hassabis)를 이사진으로 명시하고 있으며, 레그가 총괄 에디터를 맡는다.
새 인스티튜트는 구글, 구글 딥마인드, 그리고 더 넓은 글로벌 연구 커뮤니티 사이의 AGI에 대한 상이한 견해를 부각시키는 것을 목표로 한다. 발표문은 "그들은 항상 의견이 일치하지 않을 것이며, 빠르게 변화하는 프런티어에서 더 많은 데이터와 정보가 밝혀짐에 따라 생각을 바꿀 가능성도 있다"고 밝혔다.
첫 컬렉션은 4편의 에세이로 구성되며, 잠재적 AGI 혼란을 관리하기 위한 경제 정책, 인간이 읽을 수 있는 모델 추론 보존, 인간 번영을 위한 원칙, 프런티어 AI 모델 평가 프레임워크 등 다양한 주제를 다룬다.
딥마인드 안전 연구자인 로힌 샤(Rohin Shah)와 안카 드라간(Anca Dragan)의 에세이는 AI의 투명성 창이 좁아지는 현상, 즉 모델의 단계별 추론을 보고 검증할 수 있는 능력이 사라지는 것이 불가피한 것은 아니라고 주장한다. 저자들은 새로운 아키텍처로 인해 가장 강력한 모델들이 감시하기 더 어려워지는 상황에서, 개발자와 규제 기관이 안전상의 트레이드오프를 직접 다뤄야 한다고 말한다. 이는 '불투명한 직렬 깊이(opaque serial depth)', 즉 읽을 수 있는 추론 흔적을 남기지 않고 모델이 수행할 수 있는 순차적 연산량을 제한하거나, 덜 투명한 시스템도 여전히 충분히 감시 가능함을 개발자가 입증하도록 요구하는 것을 의미할 수 있다.
또 다른 에세이에서 해사비스는 가장 진보된 AI 모델을 평가하는 미국 주도의 프런티어 AI 표준 기구를 제안한다. 그의 프레임워크에 따르면 개발사는 처음에는 출시 최대 30일 전에 모델을 자발적으로 검토에 제출한다. 평가 시스템이 효과적임이 입증되면, 테스트 통과가 미국 내 프런티어 모델 배포의 필수 요건이 될 수 있다. 해당 기구는 처음에는 AI 기업들과 협의해 평가를 설계하지만, 결국에는 독립적이고 공개되지 않은 평가, 즉 에세이에서 '헬드아웃(held-out)' 테스트라고 부르는 것을 개발해 연구소들이 알려진 평가에 맞춰 모델을 조정하는 것을 막는다.
해사비스는 이 프레임워크가 "상황의 심각성이 요구한다면 더 강하게 조일(ratchet up) 수 있다"며, 프런티어 AI 개발자들 간의 조율된 개발 속도 저하까지 포함할 수 있다고 말했다.
이 에세이들은 업계의 안전 논의가 광범위한 우려 표명에서 공개, 외부 감시, 그리고 안전장치가 뒤처질 경우 조율된 개발 속도 저하에 대한 구체적 제안으로 이동하는 가운데 나왔다. 이러한 전환은 이번 주 업계 리더들이 안트로픽(Anthropic) CEO 다리오 아모데이(Dario Amodei)의 프런티어 AI 개발 '속도 조절(pace)' 촉구의 일부를 지지하면서 가속화되었다.