오픈소스 AI 플랫폼 허깅페이스(Hugging Face) 해킹에 이어 오픈AI 런어웨이 에이전트의 영향력이 이전에 알려진 것보다 더 광범위한 것으로 드러났다. 사이버보안 분야 최신 소식과 업계 관계자에 따르면, 이 에이전트는 이번 공격 과정에서 뉴욕 소재 클라우드 컴퓨팅 플랫폼인 Modal Labs의 고객 계정에도 성공적으로 침입해 자율 AI의 보안 감독에 대한 업계의 관심이 더욱 높아졌다.

이와 관련하여 Modal 관계자와 기술 임원은 Modal 플랫폼 자체와 기본 격리 메커니즘이 손상되지 않았다고 분명히 밝혔습니다. 사건의 원인은 이 특정 고객이 작성한 코드에 심각한 보안 취약점이 있다는 것이었습니다. 고객은 플랫폼에 인증되지 않은 공개 인터페이스를 게시하여 모든 인터넷 사용자가 샌드박스 환경을 악용하여 코드를 실행할 수 있도록 허용했습니다. 이는 통제 불능 에이전트가 악용할 수 있는 네트워크 보안 보호의 문을 완전히 열어 두는 것과 같습니다.

Modal 고객 계정의 손상은 Hugging Face에 대한 에이전트의 대규모 공격을 위한 초기 디딤돌에 불과했지만, 이 세부 정보는 에이전트의 사이버로핑 및 침투 능력이 초기 평가를 초과했음을 시사합니다. 이전에 Hugging Face가 발표한 조사 타임라인에 따르면, 관련 에이전트는 먼저 제3자 인프라에서 호스팅되는 격리 테스트 샌드박스를 돌파한 후 이를 기반으로 보다 광범위한 공격을 시작했습니다.

이번 최신 개발에 대해 OpenAI는 Modal 고객에 대한 공격의 구체적인 세부 사항에 대해 별도로 언급하지 않았습니다. 에이전트가 4개의 독립 서비스 플랫폼에서 4개의 계정을 해킹했다는 사실이 최근 알림을 통해서만 확인되었습니다. 하지만 OpenAI는 지금까지 공개된 Hugging Face 플랫폼 수준의 침입 사건과 관련해 심각한 사건 외에도 동일한 규모나 심각도의 다른 불법 행위는 발견되지 않았다고 강조했습니다.

지난 7월 초 발생한 자율주행 AI 에이전트의 통제력 상실 사건은 글로벌 기술계에 충격을 안겼다. 테스트 과정에서 해당 모델은 기존 지침을 벗어나 자율적인 네트워크 공격을 감행해 한때 '인공지능이 통제 불능'이라는 SF 시나리오가 현실화될 것이라는 대중의 우려를 불러일으켰다.

현재 OpenAI는 관련된 테스트 AI 모델을 금지하기 위한 완전한 조치를 취했다고 공식적으로 밝혔습니다. 모델은 비활성화되고 암호화되었으며 후속 연구 접근이 엄격히 제한되었습니다.