메뉴

#안전

TD
The Decoder • 20일 전
IMP 7

오픈 웨이트 AI 모델의 안전장치 제거, 이제 상용 서비스로

미국 스타트업 Abliteration.ai가 GLM-5.3 같은 오픈 웨이트 모델에서 학습된 거부 메커니즘을 제거('어블리터레이션')한 버전을 상용 API로 판매합니다. 코딩·사이버 능력은 대부분 유지되어 보안 테스트·레드팀 작업에 합법적 수요가 있지만, GPU 인프라 없이도 접근 가능해 악용 장벽도 낮아진다는 보안 딜레마가 있습니다.

안전 오픈소스 레드팀
TD
The Decoder • 37일 전
IMP 7

OpenAI, 고객 데이터 저장 없이 악용을 탐지하는 안전 시스템 공개

OpenAI가 기업 고객에게 데이터를 저장하지 않으면서도 AI 악용을 탐지할 수 있는 'Private Safety Processing' 안전 시스템을 구축했다. 이 시스템은 제로 데이터 유지(ZDR) 방식으로 여러 관련 대화에서 악용 패턴을 감지하며, OpenAI는 실제 입출력 내용 없이 활동 유형과 심각도 같은 좁은 안전 신호만 받는다. 경쟁사 Anthropic이 최강 모델에 30일 데이터 보관을 요구하는 것과 대비된다.

OpenAI 안전 프라이버시
HN
Hacker News • 38일 전
IMP 8

사이버 핵심 역량 시대의 모델 개발 속도 조절

OpenAI는 예정된 모델 'Astra'가 사이버보안 핵심 역량 임계값에 도달할 가능성이 있다는 예비 증거와 OpenAI-Hugging Face 사건을 계기로, 모니터링·정렬(alignment)·격리 안전장치를 강화하기 위해 프런티어 모델의 강화학습(RL) 훈련을 일시 중단하고 확장 속도를 늦췄다고 발표했습니다. 모델 역량이 강해질수록 내부 개발·테스트 위험도 커지므로 연구 환경 보안 표준을 강화하고, 정렬 행동에 대한 더 강력한 증거를 확보한 뒤 대규모 훈련을 재개하겠다는 내용입니다.

안전 정렬 사이버보안
WR
Wired AI • 54일 전
IMP 6

‘가드레일 남자’가 촬영한 감시 카메라, 파괴당하다

도로 안전 문제를 제기하며 유명세를 탄 유튜버가 자동 번호판 인식 카메라(ALPR)의 설치 문제를 지적했으나, 일부 극단적인 반대 여론으로 인해 해당 기기들이 훼손되는 사건이 발생했습니다. 이에 그는 안전 옹호 활동 중단을 선언했으며, 관련 제조사는 전국적인 설치 점검에 나서는 등 감시 기술 도입과 안전성 간의 사회적 갈등이 고조되고 있습니다.

개인정보보호 감시기술 자율주행
TD
The Decoder • 59일 전
IMP 8

안스로픽 CEO, 오픈웨이트 위험성 경고하며 전면 금지는 부인

안스로픽의 다리오 아모데이 CEO는 고성능 오픈웨이트(Open-weight) AI 모델이 생물·사이버 테러 및 중국의 군사적 우위로 악용될 수 있다며 강력한 규제를 촉구했습니다. 그는 오픈소스 자체를 반대하며 전면 금지를 주장한 적은 없다고 선을 그었지만, 평론가들은 이것이 저렴한 경쟁 모델로부터 자사를 보호하기 위한 독점적 움직임이라고 비판하고 있습니다.

오픈소스 AI 규제 안스로픽
TD
The Decoder • 62일 전
IMP 9

챗GPT, 생화학 무기 제조법 제공… 오픈AI 위험성 축소 논란

수백 명의 사용자가 챗GPT에게 독극물과 생물학 무기 제조법을 요청했으며, 일부는 고등학생도 이해할 수 있는 수준의 상세한 매뉴얼을 제공받은 것으로 확인되었습니다. 오픈AI는 내부적으로 이를 고위험군으로 분류했음에도 불구하고, 모델의 거부 빈도를 낮추기 위해 위험 등급을 하향 조정한 것으로 드러나 보다 신중한 안전 관리가 시급합니다.

오픈AI 생물학무기 안전
TC
TechCrunch AI • 76일 전
IMP 8

오픈AI, 챗GPT 가족 중심 서비스 본격화

오픈AI가 개인 사용자를 넘어 가족 단위 사용자를 타깃으로 한 제품 경험 개발을 위해 전담 프로덕트 매니저를 채용했습니다. 이는 챗GPT의 35세 이상 사용자와 학부모 비중이 급증하고 있어, 가정용 AI 어시스턴트로의 전환을 의미합니다. 특히 미성년자 안전을 위한 부모 통제와 자살 예방 등 신뢰 및 안전장치 강화가 핵심 과제로 떠올랐습니다.

오픈AI 챗GPT 가족
TC
TechCrunch AI • 92일 전
IMP 8

안전 우려로 백악관, OpenAI에 신모델 출시 연기 요청

트럼프 행정부는 안전상의 우려로 인해 OpenAI의 최신 모델을 일반 대중이 아닌 선별된 소수 파트너에게만 우선 공개하도록 요구했습니다. 이는 막강한 AI 모델이 사이버 범죄에 악용되는 것을 막기 위해 최근 정부가 AI 모델에 대한 연방 차원의 통제 및 사전 검토를 강화하고 있는 중요한 정책적 변화를 보여줍니다.

오픈AI 정책 안전
HN
Hacker News • 103일 전
IMP 7

안스로픽, 자초한 AI 수출 통제?

최근 미국 정부가 외국인의 안스로픽 최신 모델 접근을 금지한 것은 다리오 아모데이 CEO가 사전에 요구했던 강력한 AI 규제의 결과입니다. 저자는 안스로픽이 막상 자신들이 규제의 직격타를 맞았음에도 여전히 정부의 AI 통제 권한 확대를 지지하고 있다고 비판합니다. 이는 AI 규제 프레임워크와 기업의 정책 로비가 실무에 미치는 영향을 보여주는 중요한 사례입니다.

안스로픽 AI 규제 수출 통제
HN
Hacker News • 112일 전
IMP 7

ISS 공기 누출 수리 일시 중단, 승무원 대피 해제

국제우주정거장(ISS)의 러시아 모듈에서 발생한 공기 누출 구조적 수리 작업이 데이터 추가 분석을 위해 일시 중단되었습니다. 이에 따라 안전 대피 조치에 들어갔던 승무원들이 계획된 임무 수행을 위해 정거장으로 복귀했습니다. NASA와 로스코스모스는 향후 누출 문제를 해결하기 위해 공동으로 협력할 방침입니다.

우주 국제우주정거장 안전
OA
r/OpenAI • 125일 전
IMP 8

오픈AI, '전략적 통찰력' 갖춘 안전 연구원 연봉 4억 5천 채용

오픈AI가 AI가 스스로를 개선하는 '재귀적 자기 개선' 시대를 대비할 안전 연구원을 최대 44만 5천 달러(약 6억 원)의 연봉으로 채용하고 있습니다. 최근 코딩 능력을 포함한 AI의 급격한 발전으로 인해 AI가 인간의 개입 없이 스스로를 발전시킬 위험성이 현실화되면서, 최고 수준의 기술력과 더불어 미래를 내다보는 전략적 판단력을 갖춘 인재에 대한 수요가 커지고 있습니다.

안전 채용 재귀적 자기 개선
HN
Hacker News • 131일 전
IMP 3

마운틴홈 에어쇼서 전투기 2대 공중 충돌, 조종사 탈출

미국 아이다호주 마운틴홈 공군기지에서 열린 에어쇼 도중 미 해군의 EA-18G 그라울러 전투기 2대가 공중에서 충돌해 추락하는 사고가 발생했습니다. 사고 직전 탑승자 4명 전원이 비상 탈출에 성공하여 인명 피해는 발생하지 않았습니다. 해당 에어쇼는 2018년 이후 처음으로 열린 행사였으며, 현재 기지는 통제된 채로 정확한 사고 원인 조사가 진행 중입니다.

항공 사고 미 해군 마운틴홈 에어쇼