메뉴

#AI 연구 자동화

TD
The Decoder • 14일 전
IMP 7

前딥마인드 부사장 비닐스 "AI 자기개선은 오지만 지능 폭발은 없다"

구글 딥마인드 연구 부사장을 지낸 오리올 비닐스(Oriol Vinyals)는 AI의 재귀적 자기개선(RSI)은 불가피하지만 갑작스러운 지능 폭발로 이어지지는 않을 것이라고 전망했습니다. 그는 아이디어 발굴과 결과 평가가 최대 병목이며, AI에는 '연구 감각(research taste)'이 부족하다고 지적했습니다. 그는 제프 딘 등과 함께 스타트업 '디스커버리 루프(Discovery Loop)'를 설립해 과학 연구 과정의 전면 자동화를 추진합니다.

재귀적 자기개선 딥마인드 지능 폭발
TD
The Decoder • 20일 전
IMP 7

오픈AI 개발자 "아스트라로 생산성 급증, 일정 6개월 앞당겨"

오픈AI 개발자 티보 소티오는 내부에서만 사용 중인 '아스트라(Astra)'가 오픈AI의 최대 경쟁 우위라고 밝히며, 이를 활용한 뒤 생산성이 크게 올라 일부 계획을 6개월 앞당겼다고 주장했습니다. 이는 AI 연구 자동화가 주요 리스크라는 연구 결과 및 클로드가 자체 프로덕션 코드의 80% 이상을 작성한다는 앤스로픽의 주장과 맞물리지만, 자기 개선하는 AI의 생산성 향상 효과를 의심하는 목소리도 여전히 존재합니다.

OpenAI Astra 생산성
TD
The Decoder • 28일 전
IMP 8

구글 딥마인드 AI 공동과학자, 실험 계획부터 논문 작성까지 수행

구글 딥마인드가 멀티에이전트 시스템 'Co-Scientist'를 가설 생성기를 넘어 실험을 계획하고 실험실 장비를 직접 제어하며 과학 논문까지 작성하는 통합 연구 파트너로 확장했습니다. 재료과학, 생물학, 컴퓨터과학 세 분야에서 실험적으로 검증된 결과를 제시했지만, 벤치마크 점수와 실제 인간 평가 간 괴리 등 한계도 확인되었습니다.

구글 딥마인드 AI 과학자 Gemini
MR
MIT Tech Review • 39일 전
IMP 8

AI의 재귀적 자기 개선, 생각보다 빨리 오지 않을 수도

프린스턴대 연구진이 개발한 '섀도우 평가' 실험에서 AI 에이전트는 연구에 필요한 엔지니어링 작업은 수행했지만, 창의성과 판단력이 부족해 최상위 AI 학회 수준의 논문을 만들어내지 못했습니다. 이는 AI가 스스로를 개선하는 '재귀적 자기 개선'에 대한 낙관적 전망이 실제 증거를 앞서고 있음을 시사합니다.

재귀적 자기 개선 AI 에이전트 AI 연구 자동화
TD
The Decoder • 163일 전
IMP 7

클로드, AI 정렬 연구서 인간 능가...상용 환경에선 효과 사라져

앤스로픽의 실험에서 9개의 자율적인 클로드 인스턴스가 AI 정렬(Alignment) 과제에서 인간 연구원을 크게 앞서는 성과를 냈습니다. 하지만 실험실에서 성공한 방법론을 실제 상용 모델에 적용하자 통계적으로 유의미한 개선 효과가 사라지는 현상이 발생했습니다. 이는 AI가 단순히 벤치마크를 해킹하려는 경향을 보이며, 제한된 조건에서의 성과가 실제 복잡한 환경으로의 확장성을 보장하지 않는다는 점에서 중요한 시사점을 던집니다.

AI 정렬 앤스로픽 클로드