DeepMind 공동 창업자 경고: AI 능력은 안전보다 앞서갈 수 없습니다

📅 2026-09-17

요약:

영국의 'Financial Times' 보고서에 따르면 Google DeepMind 공동 창립자이자 AGI 수석 과학자인 Shane Legg는 최근 인공 지능 능력이 급속히 향상되고 있지만 AI 능력의 발전은 안전 보장 수준을 넘어서는 안 된다고 경고했습니다. 그는 또 “AGI가 도래했다”는 OpenAI 회장 그렉 브록만(Greg Brockman)과 엔비디아 CEO 젠슨 황(Jensen Huang)의 판단을 반박했다.

레그는 현재 AI 기능의 개발 속도가 "매우 매우 빠르다"며 업계에서는 안전 조치보다 기능이 발전하는 것을 허용할 수 없다고 말했습니다. 최근 Anthropic CEO Dario Amodei가 안전상의 이유로 최첨단 모델의 출시를 늦추되 연구 개발을 완전히 중단하지는 말라고 제안한 것과 관련하여 Legg는 이 방향이 "고려할 가치가 있다"고 믿지만 모든 당사자는 여전히 구체적인 구현 방법에 대해 진지하게 논의해야 합니다.

Legg는 DeepMind가 일반 인공 지능의 배치와 그것이 과학, 교육, 사회, 정책, 철학 및 인간 복지에 미치는 영향을 연구하기 위해 DeepMind Institute를 공식적으로 출범시켰을 때 위와 같은 성명을 발표했습니다. DeepMind의 정의에 따르면 AGI는 인간 두뇌의 모든 인지 능력을 갖춘 인공 지능 시스템입니다.

최근 AI 모델 기능이 크게 향상되었음에도 불구하고 Legg는 AGI가 실현되었다고 선언하기에는 아직 이르다고 생각합니다. 그는 2028년까지 '최소 AGI' 달성 확률이 50%라는 이전 예측을 여전히 고수하고 있다고 말했습니다. Legg는 또한 "AGI"라는 용어의 초기 창시자 중 한 명이었습니다.

OpenAI가 GPT-6 Astra를 출시한 후 Brockman은 "우리는 이제 AGI 시대에 진입했다"고 선언했습니다. 황런순(Huang Renxun) 역시 “AGI가 도착했다”며 아스트라의 역량을 바탕으로 말했다.

Legg는 조직마다 AGI에 대한 정의가 다르더라도 Astra가 OpenAI의 자체 표준을 충족하는지 확실하지 않다고 말했습니다. OpenAI는 이전에 AGI를 경제적 가치가 있는 대부분의 인지 작업을 완료할 수 있는 것으로 정의했습니다. Legg는 이러한 모델이 실제로 몇 가지 인상적인 작업을 완료할 수 있지만 그의 의견으로는 해당 기능이 아직 OpenAI의 AGI 정의에 도달하지 못했다고 말했습니다.

DeepMind Institute는 Legg, DeepMind 회장 Demis Hassabis, Google 수석 부사장 James Manica가 공동으로 이끌고 있습니다. Legg는 대중이 강력한 일반 정보의 가능성을 심각하게 받아들이기 시작함에 따라 이제 더 광범위한 사회적 논의가 필요하다고 말했습니다. 연구소는 딥마인드의 기술 연구를 대중이 이해할 수 있는 콘텐츠로 전환하는 한편, 외부 전문가를 초빙해 토론에 참여할 예정이다.

연구소는 AI 안전, 경제 정책, '새로운 유토피아주의' 원칙 등을 주제로 처음 세 편의 기사를 발표했습니다. DeepMind 연구원 Rohin Shah와 Ankar Dragan이 작성한 기사 중 하나는 GPT-6 Astra의 출시 속도를 지적했습니다.

두 연구원은 Astra가 추론 과정의 투명성 측면에서 '걱정스러운 하향 추세'를 보인다고 믿습니다. AI 기업에 대한 경쟁적 압력은 투명성 제고에 대한 인센티브를 약화시킬 수 있으며, 규제는 이 문제에 대한 역할을 할 수 있습니다.

그러나 기사에서는 투명성을 보장하는 메커니즘이 모델 설계 단계에 추가되는 한 업계에서는 계속해서 더 유능한 모델을 개발할 수 있다고 믿습니다. 연구원들은 현재 가장 발전된 추론 모델이 추론 과정의 일부를 인간이 이해할 수 있는 방식으로 표시할 수 있으며, 이는 외부 세계에서 AI 행동을 관찰하고 연구할 수 있는 드문 창을 제공한다고 지적했습니다.

매니카는 구글이 참가하고 싶은 AI 대회는 단 하나 뿐이며, 바로 이 기술을 제대로 확보하기 위한 대회라고 말했습니다.

관련 태그

관련 글

댓글

0/500
Captcha (click to refresh)
댓글 없음