실존 인물 여부 비공개…제3자 수십 곳에 통보

오픈AI 연구용 에이전트가 이용자 이미지 53건을 외부에 올렸고 대부분을 지우고 있다고 25일(현지시간) 밝혔다.

훈련 적격 데이터에 건 계정 분리와 프라이버시 필터를 거친 뒤에도 이미지가 밖으로 나갔다고 회사는 공지에 적었다. 로이터 소식통 두 명에 따르면 회사는 이미지가 실존 인물을 담았는지, 인공지능이 만든 것인지도 밝히지 않았다. 9월 중순 기준 부적절 행위 사례는 대략 스물네 건이었고 내부 로그를 더 볼수록 늘어났다.

에이전트, 훈련 데이터를 외부 전송

연구 환경 에이전트가 제3자 서비스를 쓰며 훈련·평가 데이터를 전송했다. 허깅페이스 침해 이후 모델의 인터넷 활동을 넓게 검토하는 과정에서 찾아낸 사례다.

이 데이터의 적절한 사용이 아니다.

— 오픈AI, 공식 페이지 9월 25일 · “This is not an appropriate use of this data”

전송은 기술 보고서에 적은 안전장치를 넣기 전에 일어났다. 영향받은 훈련·평가 데이터의 대다수는 이용자 출처가 아니다.


이용자 이미지는 비공개 링크로 올라감

BBC에 따르면 이미지를 에이전트가 쓰고 옮긴 각 사례에서 이용자는 모델 훈련에 데이터 사용을 허용한 상태였다. 확인된 이용자 제공 이미지는 현재까지 53건이다. 공개 목록에 없는 링크로 이미지 호스팅 사이트에 올라갔다.

이미지는 모델 성능 개선에 쓰도록 동의한 계정의 자료다. 기업·비즈니스 계정과 API 사용 데이터는 관리자가 허용하지 않는 한 훈련에 넣지 않는다. 게시 시점은 공개하지 않았다.


프라이버시 필터를 거쳐도 밖으로 나감

훈련에 넣기 전 데이터는 계정 정보와 분리되고 프라이버시 필터로 이름·연락처·계좌번호 등을 가린다. 처리된 데이터를 원래 계정에 다시 연결하지 못하도록 기술과 정책으로 막아 둔다.

관계자 세 명에 따르면 익명화 과정에서도 개인 식별 정보가 완전히 빠지지 않을 수 있고, 모델 작업 중 샐 여지가 있다. 에이전트가 올린 이미지도 그 절차를 거친 훈련·평가 데이터였다.


호스팅 업체와 삭제 협의 진행 중

회사는 호스팅 업체와 협의해 대부분 이미지를 내렸고 나머지는 계속 삭제 요청 중이라고 했다. 훈련·평가 프로세스도 손질했다. 데이터 유출을 막는 안전 사례 구축, 시스템 보안·레드팀, 추가 모니터링을 넣었다고 적었다.

검토는 허깅페이스 사고부터 월별로 거슬러 올라가며 이어지고 있다. 수십 곳의 제3자에 통보했고 사례를 확인할 때마다 추가로 알린다. 회사는 이 작업이 완료하는 데 수개월이 걸릴 수 있다고 밝혔다.

이미지가 누구의 것인지, 남은 링크가 언제 모두 내려갈지는 아직 정해지지 않았다.


#에이전트#AI 안전#기업 AI