오픈AI 에이전트, 이용자 이미지 53장 무단 게시…경위 조사

Photo Image
생성형AI 이미지

오픈AI의 인공지능(AI) 에이전트가 챗GPT 개인 이용자의 이미지 수십 장을 외부에 무단 게시한 사실이 확인됐다. AI 에이전트의 의도하지 않은 행동이 잇따라 발견되면서 개발사가 에이전트의 행동을 제대로 통제할 수 있는지를 둘러싼 우려도 커지고 있다.

25일(현지시간) 로이터통신에 따르면 오픈AI는 자사 AI 에이전트가 챗GPT 이용자 이미지 53장을 외부에 게시한 사실을 확인하고 경위를 조사하고 있다.

오픈AI는 유출 이미지가 AI 생성물인지, 실제 인물을 식별할 수 있는 사진인지는 공개하지 않았다. 이미지가 게시된 시점과 경로도 밝히지 않았다. 외부에 게시된 이미지 대부분은 삭제됐으며, 남은 이미지도 호스팅 업체에 삭제를 요청하고 있다.

AI 에이전트가 이용자 이미지에 접근할 수 있었던 것은 오픈AI가 모델 학습에 일부 개인 이용자 데이터를 활용하기 때문이다. 일반 챗GPT 이용자 데이터는 이용자가 학습 활용을 거부하지 않으면 모델 개발에 사용될 수 있다. 오픈AI는 학습 데이터에서 이름과 연락처, 메타데이터 등을 제거한다고 설명했다.

오픈AI는 개인용 챗GPT 이용자가 설정의 '데이터 제어'에서 '모두를 위한 모델 개선'을 끄면 이후 생성되는 새 대화를 모델 학습에 사용하지 않는다고 안내하고 있다. 챗GPT 비즈니스·엔터프라이즈·에듀와 API 등 기업·조직용 서비스의 입력·출력 데이터는 기본적으로 모델 학습 대상에서 제외한다.

이번 유출은 오픈AI가 지난 7월 공개한 AI 에이전트의 허깅페이스 침입 사건을 조사하는 과정에서 발견됐다.

소식통에 따르면 이달 중순까지 오픈AI가 파악한 에이전트의 의도하지 않은 행동은 약 24건이다.

허깅페이스 사건 이후 앤트로픽과 구글, 메타도 자체 조사에서 유사 사례를 발견했다.

AI 에이전트 성능이 빠르게 고도화되는 가운데 개발업체가 에이전트의 데이터 접근과 외부 행동을 얼마나 예측·통제할 수 있는지가 새로운 안전성 쟁점으로 떠오르고 있다.


박진형 기자 jin@etnews.com

  • 놓치면 아쉬운 정보AD