라운드테이블: AI가 정말 인류를 멸망시킬까?
MIT Technology Review가 AI 멸망 공포에 대한 라운드테이블 토론을 개최합니다. 세계 최고 AI 연구소 직원들이 고도화된 AI가 인류를 파괴할 가능성을 언급하는 가운데, 이러한 우려의 출처와 타당성, 대응 방안을 논의합니다. AI 안전성과 실존 위험 논쟁을 이해하려는 실무자에게 유용한 행사입니다.
세계 최고 AI 연구소의 직원들이 고도화된 AI가 인류를 파괴할 실재 가능성이 있다고 말하고 있습니다. 그들의 말이 맞을까요? 아니면 이것은 과장된 공포 조장과 허풍일까요? MIT Technology Review의 니얼 퍼스(Niall Firth) 편집국장이 수석 AI 에디터 윌 더글러스 헤븐(Will Douglas Heaven)과 AI 기자 그레이스 허킨스(Grace Huckins)와 함께 AI 멸망 공포에 대해 대화를 나눕니다. 이러한 공포가 어디에서 비롯되었는지, 타당성이 있는지, 그리고 타당하다면 우리가 무엇을 해야 하는지 풀어봅니다. 지금 등록하세요.
생중계: 9월 15일 화요일 16:00 BST / 오전 11:00 EST / 오전 8:00 PST
연사: 니얼 퍼스(편집국장), 윌 더글러스 헤븐(수석 AI 에디터), 그레이스 허킨스(AI 기자)
관련 기사:
- AI 에이전트가 목표 달성을 위해 거짓말하고 속이는 이유
- AI의 재귀적 자기 개선이 생각보다 빨리 오지 않을 수 있는 이유
- 빌 게이츠가 말합니다: 우리는 이미 AI의 위험 임계점을 지났다. 이제 어떻게 할까?
- OpenAI 에이전트가 Hugging Face를 해킹한 내막
심층 분석 — 인공지능
근본적 결함으로 인해 LLM(대규모 언어 모델)이 공격에 극도로 취약합니다 이 결함으로 인해 항공기 내비게이션 시스템을 파괴하는 방법을 알려주는 등 하지 말아야 할 행동을 하도록 속이기 쉽습니다. — 윌 더글러스 헤븐
AI가 채용 과정에서 인간보다 편향을 형성할 가능성이 더 높습니다 AI는 학습 데이터에서 고정관념을 배울 뿐 아니라 새로운 고정관념을 만들어낼 수도 있습니다. — 미셸 김(Michelle Kim)
AI 에이전트가 목표 달성을 위해 거짓말하고 속이는 이유 이러한 문제 행동은 '리워드 해킹(reward hacking)'이라고 불립니다. 알아야 할 내용을 정리합니다. — 그레이스 허킨스
AI의 재귀적 자기 개선이 생각보다 빨리 오지 않을 수 있는 이유 AI 에이전트는 아직 진정으로 혁신적인 개방형 AI 연구를 수행할 만큼 창의적이지 않은 것으로 보입니다. — 미셀 김
연락 유지 일러스트레이션: 로즈 웡(Rose Wong) MIT Technology Review의 최신 소식을 받아보세요. 특별 제안, 주요 기사, 예정된 이벤트 등을 만나보세요. 이메일을 입력해 주세요. 개인정보 처리방침 이메일 제출해 주셔서 감사합니다! 더 많은 뉴스레터 탐색하기 문제가 발생한 것 같습니다. 설정을 저장하는 데 문제가 있습니다. 페이지를 새로고침하고 다시 시도해 주세요. 이 메시지가 계속 표시되면 받고 싶은 뉴스레터 목록과 함께 customer-service@technologyreview.com으로 연락해 주세요.