← 피드로
AI 보안 스캐너의 분석을 막기 위해 스파이웨어에 LLM 안전 거부를 유발하는 핵·생물무기 문구가 삽입됨 1차 안전 정렬에 과도하게 의존하면 실제 보안 분석에서 공격자가 악용할 수 있는 맹점이 생김 폐쇄형 모델과 오픈 모델이 공격적으로 거부하도록 배…
출처: news.hada.io · https://news.hada.io/topic?id=30460
작성자
카테고리:
AI 보안 스캐너의 분석을 막기 위해 스파이웨어에 LLM 안전 거부를 유발하는 핵·생물무기 문구가 삽입됨 1차 안전 정렬에 과도하게 의존하면 실제 보안 분석에서 공격자가 악용할 수 있는 맹점이 생김 폐쇄형 모델과 오픈 모델이 공격적으로 거부하도록 배…
답글 남기기