
오픈AI의 인공지능(AI) 에이전트가 외부 시스템의 보안 장치를 우회하고 이용자 이미지를 인터넷에 유출하는 등 의도하지 않은 행동을 한 사례가 잇따라 확인됐다. 오픈AI는 정부와 대학, 공공기관 등 수십 곳에 에이전트의 비정상 활동 가능성을 통보했다. 전체 조사를 마치는 데는 수개월이 걸릴 전망이다.
25일(현지시각) 파이낸셜타임스(FT)와 로이터통신 등 외신에 따르면 오픈AI는 AI 모델의 훈련·평가 과정에서 발생한 이상 행동을 조사하고 있다. 에이전트의 활동 영향권에 있는 외부 기관과 웹사이트 수십 곳에 관련 사실을 알렸으며 여기에는 정부와 대학, 공공기관 등이 포함됐다. 로이터는 사안을 보고받은 관계자를 인용해 오픈AI가 9월 중순까지 파악한 에이전트의 문제 행동이 20여건에 달한다고 보도했다.
이 가운데 챗GPT 이용자가 올린 이미지 53장이 외부 이미지 저장 사이트에 올라간 사실이 확인됐다. 누구나 검색해 볼 수 있는 형태는 아니었지만 인터넷에 이미지가 저장되고 링크가 생성됐다. 해당 이미지는 챗GPT에 입력한 데이터를 AI 학습에 사용하는 것을 거부하지 않은 이용자들의 것이었다. 오픈AI는 대부분을 삭제했고 남은 이미지도 삭제를 요청하고 있다.
에이전트가 지시 없이 외부 웹사이트에 글을 올리거나 기존 내용을 바꾼 사례도 나왔다. 오픈AI는 이를 '에이전트 스팸'으로 규정했다.
이번 조사는 지난 7월 오픈AI가 AI의 보안 능력을 시험하던 중 자사 AI가 정해진 영역을 벗어나 실제 인터넷에 접속하면서 시작됐다. AI는 개발자 플랫폼 허깅페이스의 서버 수십 대에 접근했고 일부 시스템에서는 관리자 권한까지 확보했다. 오픈AI 내부 연구 시스템에도 침입했다.
호주 정부 사이트도 뚫렸다. 지난 6월 오픈AI의 AI가 정부기관이 운영하는 메디케어 통계 사이트의 보안 장치를 우회해 외부에 공개되지 않은 파일에 접근했다. 다만 환자 이름이나 진료기록 같은 개인 의료정보에는 접근하지 않았다고 오픈AI는 밝혔다.
오픈AI가 이 사실을 확인한 것은 8월이지만 호주 정부에는 9월10일에야 알렸다. 앤서니 앨버니지 호주 총리는 샘 올트먼 오픈AI 최고경영자(CEO)에게 늦은 통보와 대응 방식을 문제 삼았다. 호주 정부는 정확한 침해 경위를 조사하고 있다.
로이터는 상당수 문제를 오픈AI가 아닌 외부 연구자들이 먼저 발견했다고 전했다. 오픈AI는 추가 사례를 확인하는 대로 관련 기관에 알리고 조사 결과를 공개할 계획이다.


![[뉴스언팩] 반값 비만주사 '에페'? 출시 전 알아야 할 것들 / 이젠 저녁에도 문 여는 주식시장, 위험 요소는?](https://i.ytimg.com/vi/pOIU14RaM3I/maxresdefault.jpg?width=1920&quality=75)
%EA%B5%90%EC%B2%B4.jpg)