Google DeepMind의 CEO 데미스 허사비스(Demis Hassabis)가 프런티어 AI 모델의 출시를 관리하기 위한 규제 프레임워크를 제안했습니다. 그는 현재의 파편화된 정부 검토 시스템을 전문적이고 기술적으로 엄격한 감독 시스템으로 대체할 전문 표준 기구를 원하고 있습니다.
인공지능을 위한 FINRA 모델
그는 자신의 제안서인 “프런티어 AI를 위한 프레임워크와 새로운 시대의 서막(A Framework for Frontier AI and the Dawning of a New Age)”에서 새로운 기구를 금융산업규제기구(FINRA) 모델에 기반하여 설계했습니다. 그는 미국 정부의 지원을 받되 AI 산업계의 자금 지원을 받는 독립적인 조직을 구상하고 있습니다.
이 메커니즘은 두 단계로 작동합니다. 먼저, 프런티어 연구소들은 모델을 공개하기 전 30일 동안 표준 기구(Standards Body)에 자발적으로 모델을 제출하여 검토를 받습니다. 평가 프로토콜의 효과가 입증되면, 시스템은 의무 사항으로 전환됩니다. 즉, 프런티어 모델이 미국 시장에 진입하려면 표준화된 테스트를 통과해야 합니다. 이러한 설계는 배포 전후 모두에서 치명적인 취약점을 포착할 수 있게 합니다.
현재 감독 체계의 결함 해결
허사비스가 전담 기구를 추진하는 이유는 현재의 규제 노력이 불충분하다고 보기 때문입니다. 그는 최근 미국 정부가 Anthropic의 Mythos와 OpenAI의 Sol에 대해 실시한 검토를 경고 사례로 언급했습니다. 해당 평가들은 깊이 있는 기술적 전문성 부족과 출시 일정에 대한 불투명한 의사결정으로 인해 반발을 샀습니다.
자율 규제 기구는 산업계가 현재 AI 감독을 둘러싼 정치적 마찰을 피할 수 있게 해줍니다. 백악관 AI 고문인 스리람 크리슈난(Sriram Krishnan)은 최근 행정부 내에 "AI를 위한 FDA"가 생길 가능성은 낮다고 경고한 바 있습니다. FINRA 스타일의 모델은 직접적인 정부 기관의 관료적 장애물 없이 기술적 독립성을 유지할 수 있는 절충안을 제공합니다.
기술적 전문성과 확장 가능한 안전성
허사비스는 규제 인력이 반드시 산업계 내부와 오픈 소스 커뮤니티에서 충원되어야 한다고 강조합니다. 모델 아키텍처와 신규 위험 요소를 이해하는 인력으로 구성된 기구는 실제 전문성을 바탕으로 모델을 평가할 수 있습니다.
또한 이 프레임워크는 분산된 안전 접근 방식을 허용합니다. 표준 기구는 세밀한 위험 평가를 위해 전문 AI 안전 그룹과 계약을 맺을 수 있습니다. 이 조직은 분야의 급격한 발전에 맞춰 적응할 것이므로, 새롭고 더 심각한 위험이 나타남에 따라 감독 수준을 동적으로 "강화(ratcheted up)"할 수 있습니다. 이를 통해 규제는 병목 현상이 아닌 책임 있는 혁신의 촉진제 역할을 유지하게 됩니다.
핵심 요약
- 하이브리드 규제 모델: 허사비스는 프런티어 모델 출시를 감독하기 위해 FINRA를 모델로 한, 산업계가 자금을 지원하고 정부가 뒷받침하는 독립 기구를 제안합니다.
- 단계적 이행: 이 계획은 자발적인 30일 사전 출시 검토로 시작하여 미국 시장을 위한 의무 준수 단계로 넘어갑니다.
- 기술적 엄격함: 해당 기구는 산업 전문가와 오픈 소스 대표자들을 영입하여 현재 정부 주도 검토에서 나타나는 "전문성 격차"를 해소할 것입니다.
