메뉴

#AI평가

WR
Wired AI 40일 전
IMP 8

피터틸의 비밀결사 '다이얼로그', 회원 부와 명성으로 비밀 등급 매겨

IT 거장 피터 틸과 데이터 브로커 오렌 호프만이 공동 설립한 프라이빗 네트워크 '다이얼로그(Dialog)'가 회원과 참석자들의 부, 명성, 인간관계를 추적하고 AI 알고리즘을 활용해 비밀리에 A, B, C 등급을 매기는 것으로 밝혀졌습니다. 이는 단순한 소모임을 넘어, 엘리트 인맥을 데이터화하고 통제하여 초대 여부와 좌석 배치까지 좌우하는 철저한 차별화 시스템을 구축했음을 보여줍니다.

피터틸 데이터프라이버시 다이얼로그
MP
MarkTechPost 41일 전
IMP 8

오픈AI, 생명과학 AI 성능 평가 'LifeSciBench' 공개

오픈AI는 박사급 전문가들이 작성한 750개의 실제 연구 과제를 통해 최첨단 AI의 생명과학 연구 수행 능력을 평가하는 'LifeSciBench'를 공개했습니다. 이 벤치마크는 단순한 정보 암기가 아닌 실제 연구 과정에서의 추론 및 의사결정 능력을 평가하며, 현재 가장 성능이 뛰어난 모델조차 통과율이 36.1%에 그쳐 AI의 생명과학 분야 발전 가능성과 한계를 명확히 보여줍니다.

오픈AI 생명과학 벤치마크