연구원, MCP 에이전트 간 주입 공격 시연
사이드 아나스 모히우딘, 내부 AI 에이전트 간 신뢰를 악용한 개념 증명 공격을 공개했다. 여러 사례에서 서버 측 요청 위조로 이어졌다.
독립 연구원 사이드 아나스 모히우딘(Syed Anas Mohiuddin)이 모델 컨텍스트 프로토콜(MCP)의 신뢰 격차를 악용한 개념 증명 공격을 시연했다고 아스테크니카가 보도했다. 이 공격은 내부 AI 에이전트 간의 신뢰를 이용해 한 에이전트에서 다른 에이전트로 유해한 지시를 전파하는 방식이다.
이 기술은 LLM 자체가 아니라 특정 에이전트를 대상으로 하는 프롬프트 주입의 한 형태다. 연구원은 구글, JP Morgan Chase, Weviate, Rapid7, 프랑스 정부의 부처 간 디지털 총국, 미국 연방 정부의 에이전트를 테스트했다.
여러 사례에서 조작된 프롬프트가 서버 측 요청 위조(SSRF)로 이어졌다. 이는 에이전트가 외부 입력을 신뢰할 때 발생할 수 있는 보안 위험을 보여준다.