요약:
OpenAI는 인공지능(AI) 모델의 개발 주기 초기에 제3자 조직이 보안 위험을 평가할 수 있도록 허용할 계획입니다. 이는 AI의 잠재적 피해를 둘러싼 우려를 해결하기 위한 지속적인 노력을 목표로 합니다. ChatGPT 개발자는 화요일 블로그 게시물을 통해 새로운 AI 모델의 훈련, 평가 및 출시 과정에서 외부 기관이 기술 보안 평가를 수행하도록 할 계획이라고 발표할 예정입니다.

OpenAI는 또한 "강력한 독립적 메커니즘, 과학적 엄격함, 강력한 보안 관행 및 명확한 책임"을 포함하여 그러한 평가가 효과적이기 위해 필요하다고 생각하는 우선순위를 나열합니다.
외부 전문가와 협력하여 회사의 보안 검토 작업 대부분을 담당하고 있는 Lama Ahmad는 이전에는 OpenAI가 일반적으로 모델 출시 전에 보안 평가를 수행하고 모델 역량을 평가하기 위해 이러한 기관을 주로 도입했다고 말했습니다.
Ahmad는 인터뷰에서 "잠재적 위험과 영향이 증가함에 따라 배포 외에도 교육 및 평가와 같은 중요한 측면도 검토하고 싶습니다"라고 말했습니다.
가장 민감한 일부 업무의 경우 OpenAI는 외부 평가자가 회사 구내에 들어와 평가를 수행하도록 허용할 수 있는데, 이는 회사가 과거에 시도했던 관행이라고 Ahmad는 말했습니다.
OpenAI 경쟁업체인 Anthropic PBC의 다리오 아모데이(Dario Amodei) CEO는 최근 AI 업계에 개발 속도 저하 지원을 촉구하고 제3자 평가 기관 도입을 포함한 새로운 보안 조치가 채택될 것이라고 말했습니다. OpenAI CEO인 Sam Altman은 나중에 이 접근 방식을 승인했습니다. Anthropic은 지난주 말 Accenture 평가자를 초빙하여 최첨단 AI 모델의 안전성을 테스트할 것이라고 밝혔습니다.
OpenAI는 블로그 게시물을 통해 회사가 이러한 평가에 관여할 수 있는 기관과 논의 중이라고 밝혔습니다. Ahmad는 AI 연구 기관인 METR과 Redwood Research를 포함하여 과거에 협력한 기관과 이전에 협력하지 않은 기관이 모두 협상 대상에 포함된다고 말했습니다. OpenAI는 이전에 이 두 기관에 Hugging Face 시스템에 대한 모델 침입을 조사하도록 의뢰했습니다.
OpenAI는 블로그 게시물에서 "AI 연구소는 민감한 정보를 보호하면서 효과적인 검토를 위한 조건을 조성할 책임이 있습니다"라고 말했습니다.
댓글