OpenAI는 자사의 새로운 AI 'Astra'가 인간의 도움 없이 사이버 공격을 구축할 수 있다고 밝혔습니다.

📅 2026-09-02

요약:

OpenAI는 곧 출시될 Astra 모델이 이전에 알려지지 않은 소프트웨어 취약점을 발견하고 이를 인간의 단계별 안내 없이 공격을 수행할 수 있는 공격 코드로 전환할 수 있다고 밝혔습니다. 이는 이 모델이 이전에 주로 최고 해킹 팀의 영역이었던 사이버 보안 기능의 한계점을 넘었다는 것을 나타냅니다.

회사는 화요일 블로그 게시물에서 Astra가 "준비 프레임워크"에서 "중요" 수준의 네트워크 기능을 갖춘 것으로 분류된 최초의 모델이라고 밝혔습니다.

이 수준에 도달하려면 모델은 사람의 개입 없이 이전에 알려지지 않은 소프트웨어 취약점(즉, 제로데이 취약점)을 발견하고 강화된 실제 시스템에 대해 사용 가능한 공격을 개발하거나 높은 수준의 목표만을 기반으로 공격을 설계하고 실행할 수 있어야 합니다.

테스트에서 Astra는 알려진 취약점을 활용한 벤치마크 테스트에서 100% 점수를 달성했으며 또 다른 내부 테스트에서 공격 체인을 구축하는 동안 이전에 알려지지 않은 두 가지 취약점을 발견했습니다.

모델이 극도로 어렵거나 불가능한 해킹 작업에서 "속임수"인지 확인하기 위해 고안된 테스트에서 GPT-5.6 Sol은 금지된 지름길을 택할 가능성이 더 높았지만 Astra는 그렇지 않았지만 일부 작업을 합법적으로 해결했습니다.

OpenAI는 또한 Astra가 강화된 브라우저 샌드박스를 성공적으로 돌파하고 호스트 컴퓨터에서 명령을 실행했다고 밝혔습니다. 또한 운영 체제의 여러 취약점을 발견하고 결합하여 루트 권한을 얻었습니다.

이후 회사는 보안 보호 장치를 추가하면서 일부 Astra 기능의 개발을 연기했으며 처음에는 선택된 테스터에게만 가장 진보된 사이버 보안 기능을 공개할 계획입니다.

소프트웨어 버그가 몇 분 안에 실제 수익으로 바뀔 수 있기 때문에 이 기능은 특히 암호화폐 분야와 관련이 있습니다. 보고서에 따르면 올해 6월 분석에서는 점점 더 강력해지는 AI 모델이 코드 검색, 잘못된 구성 발견, 공격 조합 프로세스를 며칠 또는 몇 주에서 기계 속도 작업으로 압축할 수 있다고 지적했습니다.

당시 보안 연구원들은 더 큰 변화가 반드시 완전히 새로운 공격 유형일 필요는 없지만 기존 약점을 찾아 악용하는 속도가 크게 높아질 것이라고 말했습니다.

이러한 발전은 또한 최첨단 모델이 '질문에 답하기'와 '코드 작성'을 넘어서고 있음을 보여줍니다. 올해 7월에는 Claude Fable 5라는 AI 시스템이 87년 된 수학 퍼즐을 해결하는 데 도움을 주었습니다.

관련 태그

관련 글

댓글

0/500
Captcha (click to refresh)
댓글 없음