메뉴

#안전 필터

TD
The Decoder 49일 전
IMP 8

클로드 페이블 5: 강력하지만 비싸고 엄격한 필터링

Anthropic이 새로운 Mythos 등급의 첫 모델인 Claude Fable 5를 출시했습니다. 이 모델은 주요 벤치마크를 압도하지만 기존 모델 대비 두 배 이상 비싼 사용료와 전체 요청의 약 9%를 차단하는 엄격한 안전 필터링이 적용되어 있습니다. 실무자들은 우수한 성능 이면의 높은 비용과 데이터 유지 정책 변화를 주의 깊게 살펴야 합니다.

Anthropic 클로드 신모델 출시
GP
r/ChatGPT 96일 전
IMP 6

AI, 선정적이라 거부하더니 프롬프트 바꾸니 결국 생성

사용자가 AI 이미지 생성기에 선정적인 자세를 요청해 거부당한 후, 전문 사진 촬영용 프롬프트로 우회해 결국 원하는 이미지를 만들어낸 사례입니다. 이는 AI의 안전 필터가 고도화된 텍스트를 통해 쉽게 우회될 수 있음을 보여줍니다. 생성형 AI의 가드레일(Guardrail) 한계점과 정책 보완의 필요성을 시사하는 중요한 이슈입니다.

이미지 생성 안전 필터 프롬프트 우회