요약:
AI 안전성 논란이 계속 심화되자 머스크는 “경쟁자들이 서로 확인하게 하라”고 제안했다. 그는 선도적인 AI 기업들이 모델을 출시하기 전에 서로 교차 테스트를 실시해야 한다고 주장하며, 이 메커니즘이 가능한 한 빨리 전 세계적으로 추진되어야 하며 중국의 참여가 필수적이라고 믿습니다.

현지 시간 9월 15일(현지 시간) 언론 보도에 따르면 지난 9월 13일부터 15일까지 로스앤젤레스에서 유명 기술 팟캐스트가 주최한 올인 서밋(All-In Summit)에 스페이스X CEO 일론 머스크(Elon Musk)가 영상을 통해 원격으로 참석했다.
그는 최첨단 AI 모델의 보안 문제에 대한 거버넌스 프레임워크를 제안했습니다.
선도적인 AI 기업은 모델이 공식 출시되기 전에 서로 테스트하고, 경쟁업체는 보안 위험을 발견하고 제기할 책임이 있습니다.
머스크는 이 "동료 검토" 메커니즘이 새로운 법안을 기다릴 필요가 없으며 즉시 시작할 수 있다고 말했습니다.
머스크는 이렇게 말했습니다:
"모든 AI 회사에는 모델이 생물학적 무기나 핵무기를 만드는 데 도움이 되는지, 아니면 고의적인 속임수가 있는지 확인하는 데 사용되는 일련의 테스트인 테스트 하네스가 있습니다."
"각 회사에서 다른 사람의 테스트 도구를 통해 실행하도록 하는 것이 우리 자신의 보안을 보장하기 위해 할 수 있는 최선의 방법일 수 있으며 가능한 한 빨리 홍보해야 합니다."
그는 이를 AI 기업이 더 이상 '자체 작업에 등급을 매기는' 것이 아니라 적어도 경쟁사에 의해 등급을 매기고 문제가 발견되면 경보를 울릴 수 있다는 의미로 설명했습니다.
특정 운영 수준에서 Musk는 모델 개발자가 게시하기 전에 동료에게 API 액세스를 제공해야 한다고 제안했습니다. 지적된 문제가 해결되지 않으면 경쟁업체는 해당 모델이 출시하기에 안전하지 않다고 공개적으로 선언할 수 있습니다.
그의 견해로는
이러한 공개 심문은 엄청난 법적 책임 압력을 가져오고 사실상 구속력을 형성할 것입니다
.Musk는 또한
이 프레임워크가 실제로 효과적이려면 중국이 포함되어야 한다고 강조했습니다
. 그는 "우리는 아마도 중국과 일종의 동료 검토에 합의해야 할 것"이라고 지적했다. 선도적인 AI 기업들은 모델을 출시하기 전에 서로의 모델을 테스트하는 것이다."다양한 기업의 보안 투자에 대해 말하면서 그는 대형 AI 모델 개발사인 Anthropic에 대해 비교적 긍정적인 평가를 내렸습니다. "전체적으로
ChatGPT 개발사인 OpenAI보다 Anthropic이 보안에 더 많은 노력을 투자했다고 생각합니다.
그러나 Anthropic조차도 모델에 대한 우려가 있음을 인정합니다. "머스크가 언급한 '상호 테스트' 메커니즘은 이미 업계에서 구체화됐다. 2025년 8월 27일, 두 회사의 공식 홈페이지에 동시에 공개된 보고서에 따르면 OpenAI와 Anthropic은 공동 보안 평가 결과를 발표했습니다.
두 당사자는 서로에게 API 권한을 개방하고 일부 외부 보호 조치를 완화했습니다. 그들은 자체적인 내부 정렬(즉, 모델 동작이 사람의 의도에 맞는지 여부)과 보안 테스트를 통해 상대방이 공개한 모델을 평가하고 동시에 그 결과를 발표했습니다. 선도적인 실험실이 직접 경쟁업체에 내부 테스트를 공개한 것은 이번이 처음입니다.
댓글