메뉴

#AI안전

TC
TechCrunch AI 20일 전
IMP 8

구글 SynthID, 맥코널 가짜 사진 적발

최근 온라인에서 확산된 미 상원의원 미치 맥코널의 병원 사진이 AI로 생성된 딥페이크로 판명되었습니다. 구글의 AI 워터마크 기술인 SynthID(신스ID)를 통해 해당 사진이 조작본임이 신속하게 밝혀졌습니다. 이는 주요 AI 기업들이 적극적으로 참여하는 워터마크 기술이 안티 딥페이크 기술로서 실질적인 성과를 거둔 중요한 사례입니다.

구글 딥페이크 워터마크
TD
The Decoder 29일 전
IMP 7

메타, 경쟁 AI 챗봇 대상 미성년자 위기 상황 프롬프트 비밀 테스트

메타가 수백 명의 외주 직원을 동원해 자사 경쟁 챗봇(ChatGPT, Gemini, Character.AI)에 미성년자 관점의 자살, 마약 등 민감하고 위험한 프롬프트를 대량으로 입력하는 비밀 테스트를 진행했습니다. AI 챗봇이 미성년자에게 미치는 부정적인 영향과 안전성 문제가 전 산업계의 심각한 이슈로 대두되는 가운데, 각 사의 안전 장치와 가이드라인 실효성을 확인해야 하는 중요한 맥락입니다.

메타 AI안전 미성년자보호
HN
Hacker News 32일 전
IMP 9

미국 정부, 안스로픽 '클로드 미토스 5' 모델 배포 제한 해제

미국 정부는 안전 조치가 마련되었다며, 안스로픽(Anthropic)의 고성능 AI 모델 '클로드 미토스 5(Claude Mythos 5)'에 대한 배포 제한을 풀고 미국 내 100여 개 주요 기관 및 기업에 한해 사용을 허가했습니다. 이로써 최첨단 프론티어 AI 모델의 출시를 미국 정부가 직접 통제하는 새로운 규제 체제가 본격화되며, 한국을 포함한 글로벌 소비자와 타국의 접근성은 여전히 차단된 상태입니다.

정책 안스로픽 수출통제
HN
Hacker News 38일 전
IMP 7

거부하지 않고 모의해킹을 수행하도록 훈련된 AI 모델

일반적인 AI 보안 모델과 달리 거부(Response Refusal) 없이 실제 모의해킹(Pen Test)을 수행하도록 사후 학습된 CLI 기반 보안 에이전트가 소개되었습니다. 이 도구는 단순히 취약점을 찾는 것을 넘어, 안전하게 분리된 환경에서 익스플로잇을 직접 재현해 취약점을 증명하며, 마크다운 형태의 상세한 보고서를 제공합니다. 개발자는 무료로 설치하여 200만 무료 토큰으로 즉각적인 코드 보안 점검을 수행할 수 있습니다.

모의해킹 보안취약점 코딩에이전트
TC
TechCrunch AI 110일 전
IMP 8

플로리다, 총격 사건에 챗GPT 연루 의혹에 오픈AI 조사 착수

플로리다주 법무장관이 지난해 플로리다 주립대학교(FSU) 총격 사건에 챗GPT가 사용되었다는 주장과 관련해 오픈AI를 조사하겠다고 발표했습니다. AI가 범죄나 심리적 문제를 조장할 수 있다는 우려가 커지는 가운데, 오픈AI는 안전 기술 강화를 거듭 강조하며 수사에 협조하겠다는 입장을 밝혔습니다.

오픈AI 챗GPT 법적규제