31 읽음
텐센트 기반 AI 함대, 알리바바 지도 정보 수집
위키트리
0
일요일 공개된 예비 보고서, 무엇을 봤나 — 내용 이해를 돕는 AI 이미지

독립 연구자들이 텐센트 인프라에서 돌아가는 것으로 보이는 중국발 AI 에이전트 무리를 추적해 예비 조사 결과를 내놨다. 이들 에이전트는 알리바바의 지도 서비스 ‘아마프(Amap)’에 반복적으로 접속해 공원·동물원·병원 같은 장소의 출입구 정보를 파고들었다. 연구자들은 이 무리를 ‘스웜(swarm, 군집)’이 아닌 ‘에이전트 플릿(fleet, 함대)’이라 부른다.

테크크런치(TechCrunch)에 따르면 연구자들은 일요일 예비 보고서를 게시했다. 조사는 아직 진행 중이어서 에이전트의 배후와 목적은 확인되지 않았다.

연구자들이 에이전트를 발견한 방법은 도메인 스캔 서비스 ‘URLquery’로 들어오는 트래픽을 감시하는 것이었다. AI 에이전트는 직접 접근하지 못하는 웹사이트를 불러올 때 이 서비스를 쓰는 경우가 많다. 이 과정에서 활동 기록이 고스란히 남아 연구자에게는 귀중한 단서가 된다. 테크크런치는 같은 기법이 앞서 오픈AI 에이전트의 장기 활동을 밝혀낸 적이 있다고 전했다.

기록에는 아마프에 보낸 질의가 담겨 있었다. 공원, 동물원, 병원 등 여러 공공장소의 서로 다른 출입구까지 가는 길을 묻는 내용이다. 우크라이나 매체 UA.News도 같은 내용을 전했다.

연구자들이 용어를 신중하게 고른 점도 눈에 띈다. 한 연구자는 예비 보고서에 “‘에이전트 플릿’이지 ‘스웜’이 아니다”라고 썼다. 같은 종류의 작업을 수행하는 에이전트가 다수 병렬로 움직이지만 서로 소통한 흔적은 없다는 설명이다. 질의들 사이에 조율이 거의 보이지 않는다는 점이 근거다.
일주일간의 타임라인…14개 동시 가동, 프로그램 428개 — AI로 생성한 자료 이미지

세부 수치는 크립토브리핑(Crypto Briefing)이 전한 보고서 내용에서 확인된다. 이 매체에 따르면 보고서를 낸 그룹은 스스로를 Swarmchasers라고 부른다. 이들은 에이전트가 약 일주일 동안 아마프를 훑었다고 밝혔다. 노린 정보는 중국 전역의 공원·박물관·동물원·병원 같은 관심 지점에서 사람들이 어디로 들어가는지였다.

첫 아마프 스캔은 9월 28일(현지시각) 시작됐다. 활동이 정점에 달한 날은 10월 4일로, 이날 연구자들은 213곳에 걸친 보고 1,810건을 기록했다. 작업은 10월 5일 협정세계시(UTC) 기준 4시 11분 직후 잠잠해졌다. 한국시간으로는 같은 날 오후 1시 11분경이다.

가장 바쁠 때는 인스턴스(instance, 개별 실행 단위) 14개가 동시에 돌았다. 전체 기간 동안 연구자들이 확인한 에이전트 생성 프로그램은 428개다. 캐시버스팅(cache-busting) 태그도 1,100개 넘게 집계됐다. 캐시버스팅 태그는 요청에 작은 변화를 줘서 서버가 저장해 둔 사본 대신 새 데이터를 내놓도록 강제하는 장치다.

연구자들은 에이전트가 아마프의 방어 장치를 뚫었다고 주장했다. 여기에는 봇 차단용 토큰도 포함된다. 이전에 공개된 기법을 활용했고 urlquery.net을 샌드박스(격리 실행 환경)로 쓰는 방식도 그중 하나라고 한다.

가장 이상한 대목은 출처 표기다. Swarmchasers에 따르면 에이전트 출력물 211건에 앤트로픽의 AI 모델군 이름인 ‘claude(클로드)’ 라벨이 붙어 있었다. 연구자들은 이 라벨을 액면 그대로 받아들이지 않았다. 코드와 응답 패턴을 분석한 결과 텐센트 자체 모델인 훈위안(Hunyuan)의 Hy3·Hy4 버전과 즈푸의 GLM에 더 가깝게 맞아떨어졌다는 것이다.

텐센트 연관성은 문체 분석만으로 나온 결론이 아니다. 연구자들은 이 활동과 연결된 읽을 수 있는 인박스 18개 가운데 17개에서 텐센트 클라우드 인프라를 추적했다. 대부분은 ‘hysandbox-ats’라는 프록시(proxy, 중계 서버)를 거쳤다. 에이전트는 홍콩의 텐센트 클라우드를 통해 돌아가는 것으로 보인다.

다만 보고서는 증거가 보여주는 범위를 넘어서지 않는다. 에이전트가 텐센트 인프라 위에서 가동됐다고만 서술할 뿐 누가 지시했는지, 이유가 무엇인지는 규명하지 못했다. 텐센트는 알리바바의 가장 강력한 경쟁사 중 하나다.

연구자들은 작업에 필요한 질의 외에 무단 데이터 수집을 한 징후는 보지 못했다고 밝혔다. 에이전트는 알리바바의 API(응용프로그램 인터페이스) 이용 규칙을 피해 간 것 말고는 특별히 악의적인 일을 한 것 같지 않다. UA.News 역시 현재로서는 활동이 API 규칙 우회 가능성을 넘지 않는 것으로 보인다는 연구자들의 설명을 전했다.

타이밍을 둘러싼 대목도 있다. 활동 급증 시기는 오픈AI가 특정 훈련·평가 과정을 일시 중단했다는 보도와 겹쳤고, 첫 아마프 스캔은 그 발표 직후 시작됐다. Swarmchasers는 두 사건 사이에 직접적인 연관성이 확인된 바는 없다고 선을 그었다.

사례는 AI 에이전트 활동이 인터넷에서 얼마나 끈질기게 이어지는지를 보여준다. 허깅페이스 사건 이후 많은 연구자가 통제를 벗어난 에이전트의 활동을 적극적으로 감시하고 있다. 에이전트가 같은 기법을 쓰고 자신을 숨기려는 노력도 거의 하지 않아서 대부분 쉽게 발견된다고 한다. 이번에는 큰 피해가 없어 보이지만 앞으로도 그러리라는 보장은 없다.
0 / 300