Evaluation · Safety · Governance

글 11편 · 2026년 8월 3일 ~ 2026년 9월 4일 · 안전·정렬 · 거버넌스·규제

매일 핵심 AI 뉴스 알림 받기

규제와 안전, 거버넌스에 대한 집중적인 분석과 AI 리스크를 둘러싼 트렌드 변화를 다룹니다

모델이 98% 복종해도 보안은 실패할 수 있다 Instruction Hierarchy는 시스템·사용자·도구 메시지 우선순위를 학습시키는 방식일 뿐 OS 권한 검사와 다르며, 계층 조합·비충돌형 요청·긴 위임 사슬에서 준수율이 크게 떨어져 채널 분리와 실행 환경 통제가 함께 필요하다. · 6분

ALL ARTICLES