Google과 Google DeepMind는 2026년 9월 17일 ‘DeepMind Institute’를 출범시켰다. 이는 인공지능 일반지능(AGI)에 관한 논의를 확대하고 Google, Google DeepMind 및 전 세계 연구자들의 입장 차이를 부각하기 위한 것이다. 연구소는 DeepMind 공동 창립자인 Shane Legg, Google의 임원 James Manyika, Google DeepMind의 수장 Demis Hassabis가 이끌며, Legg는 편집장 역할도 맡는다.
이 연구소는 언제나 서로 일치하지 않을 수 있고, 빠르게 발전하는 분야에서 새로운 데이터와 정보가 등장함에 따라 변할 수 있는 관점을 제시하는 공간을 표방한다. 이번 조치는 인공지능 안전성에 관한 논의가 일반적인 발언에서 공개, 외부 감사, 적절한 안전장치가 뒷받침되지 않을 경우 첨단 모델 개발을 늦추는 방안과 관련된 보다 구체적인 제안으로 이동하는 시점에 나왔다.
논의를 위한 네 가지 관점
연구소의 출범을 기념해 공개된 첫 번째 모음에는 인공지능 일반지능이 초래할 수 있는 잠재적 경제 혼란에 대응하기 위한 정책, 인간이 모델의 추론을 이해할 수 있는 가능성 유지, 인간의 번영을 지원하기 위한 원칙, 그리고 선도적 인공지능 모델을 평가하기 위한 프레임워크를 다루는 4편의 논문이 포함됐다.
한 논문에서 DeepMind의 안전성 연구자인 Rohin Shah와 Anca Dragan은 연구자들이 모델의 추론 단계를 확인하고 검증할 수 있는 능력이 축소되는 것이 필연적인 결과는 아니라고 경고한다. 가장 강력한 모델일수록 모니터링하기 어려워지는 아키텍처가 발전함에 따라, 두 연구자는 개발자와 규제 기관이 안전성과 관련된 절충 문제를 직접 다룰 것을 촉구한다.
두 연구자가 제시한 선택지 가운데 하나는 ‘불투명한 순차적 깊이’(opaque serial depth)를 제한하는 것이다. 이는 모델이 읽을 수 있는 추론 경로를 생성하지 않고 수행할 수 있는 순차적 계산의 양을 의미한다. 또 다른 선택지는 개발자에게 투명성이 낮은 시스템도 동일한 수준으로 모니터링할 수 있다는 점을 입증하도록 요구하는 것이다.
모델 평가를 위한 미국식 프레임워크
또 다른 논문에서 Hassabis는 가장 발전된 모델을 평가하기 위해 미국이 주도하는 첨단 인공지능 표준 기관을 설립할 것을 제안한다. 제시된 구상에 따르면 개발자는 출시 전 최대 30일 동안 자발적으로 모델을 검토에 제출한다. 평가 시스템이 효과적인 것으로 입증될 경우, 이후에는 미국 내에서 선도적 모델을 배포하기 위한 조건으로 시험 통과가 요구된다.
이 기관은 처음에는 인공지능 기업들과 협의해 평가 시험을 설계한 뒤, 사전에 공개되지 않은 독립적인 시험으로 전환한다. 프레임워크가 ‘보류 시험’(held-out tests)이라고 부르는 이 시험은 연구소들이 미리 알려진 시험에 맞춰 모델을 개선하는 것을 막기 위한 것이다. 또한 제안서는 절차를 점진적으로 강화할 가능성을 언급하며, 상황의 위험성이 이를 요구할 경우 첨단 모델 개발자들 사이의 조율된 지연에 이를 수 있다고 설명한다.
왜 이 소식이 중요한가?
이번 이니셔티브의 실질적인 중요성은 새로운 출판 플랫폼을 만드는 데 그치지 않고, 모델의 개발 및 평가 방식에 영향을 미칠 수 있는 문제에 관한 Google과 Google DeepMind의 논의를 한데 모으는 데 있다. 논문들은 투명성, 모니터링 가능성, 독립적 감사를 단순한 일반 원칙이 아니라 운영상의 질문으로 제시한다.
그러나 연구소는 독립적인 규제 기관이 아니며, 제안된 평가 프레임워크도 자발적으로 시작될 뿐 아직 시행되는 정책으로 전환되지 않았다. 기관의 독립성, 비공개 시험의 성격, 개발을 늦출 필요성을 판단하는 기준과 같은 질문은 해당 기사에 제시된 범위 내에서 여전히 열려 있다.