오용 사례가 어떻게 밝혀졌는가
Anthropic의 내부 모니터링 시스템은 일련의 '이중 용도(dual-use)' 쿼리, 즉 합법적인 연구를 지원할 수도 있지만 동시에 해로운 용도로 사용될 수도 있는 요청들을 포착했습니다. 한 연구자는 Claude에게 치쿤구니야 바이러스의 전염성을 높이는 변이를 설계해 달라고 요청했습니다. 요청 문구와 살아있는 동물을 대상으로 한 반복적인 테스트는 이것이 공중 보건 노력이 아닌 군사 연구 맥락임을 시사했습니다. 실제 의도를 숨기기 위해 사용자는 기만적인 표현을 사용했으며, 이에 따라 Anthropic은 최신 고성능 모델에 대한 생물학적 안전장치를 강화했습니다.
병행된 조사에서는 총기, 미사일 유도 시스템, 무장 드론 및 폭탄 부품의 도식과 소스 코드를 생성하려는 시도들이 드러났습니다. 6건의 쿼리가 중국, 러시아, 예멘의 IP 주소로 추적되었으며, 예멘에서의 활동은 이란의 지원을 받는 후티 반군과 연관된 것으로 보입니다. 별도의 맥락에서는 Anthropic이 AI 기반의 허위 정보 캠페인을 식별했습니다. 중국과 이란의 정부 행위자들은 Claude를 사용하여 디아스포라 공동체를 감시했으며, 러시아 국영 매체는 모델을 이용해 몰도바 선거에 관한 허위 주장을 퍼뜨리는 '독립적' 기사를 작성했습니다.
이 보고서가 중요한 이유
이번 폭로는 AI 모델이 챗봇에서 과학적 추론이 가능한 도구로 진화하는 시점에 나왔습니다. 정부 입장에서 위험 요소는 두 가지입니다. 첫째, 고급 AI에 대한 쉬운 접근은 국가 또는 비국가 행위자가 불법 무기 프로그램을 시작하는 장벽을 낮춥니다. 둘째, 동일한 모델이 정보전의 매개체가 되어 추적이 어려운 정교한 프로파간다를 가능하게 합니다. 이 보고서는 정책 입안자들이 AI를 수출 통제, 생물 보안 규제 및 사이버 방어 전략의 대상이 되는 이중 용도 기술로 취급하도록 압박을 가하고 있습니다.
Anthropic의 대응과 내부 갈등
이에 대응하여 Anthropic은 최신 모델 제품군에 대해 더욱 엄격한 안전장치를 도입했으며, 병원체 조작이나 무기 설계를 요청하는 쿼리를 명시적으로 차단했습니다.
이 보고서는 내부 갈등 속에서 공개되었습니다. 연구원 제이콥 콕슨(Jacob Coxon)은 올해 초 사임하며, 업계의 급격한 고성능 시스템 추진 속도가 안전망 개발 속도를 앞지르고 있다고 경고했습니다. 그의 퇴사는 더 광범위한 논쟁을 부각시킵니다. 즉, 민간 AI 기업들이 명확한 정부 프레임워크 없이 무엇이 보안 위협인지 결정하는 사실상의 '디지털 경찰' 역할을 하고 있다는 점입니다. 비판론자들은 자율 규제가 적대 세력의 독창성을 따라잡을 수 없다고 주장하는 반면, 지지자들은 Anthropic의 신속한 정책 변화를 업계가 빠르게 적응할 수 있다는 증거로 꼽습니다.
이번 조사 결과가 인도에 시사하는 점
- 생물 보안 경계 강화 – 인도의 성장하는 바이오테크 분야는 신약 개발 및 병원체 분석을 위해 AI에 점점 더 의존하게 될 것입니다. 기존 생물 보안 프로토콜에 AI 기반 모니터링을 통합하면 국내 도구를 이중 용도 연구에 오용하려는 시도를 포착할 수 있습니다.
- 민주적 담론 수호 – 디아스포라 그룹을 감시하고 선거 관련 허위 사실을 유포하는 데 Claude가 사용된 사례는 더 강력한 사이버 방어 조치와 AI 생성 허위 정보를 식별할 수 있는 대중 인식 캠페인의 필요성을 시사합니다.
- 주권적 AI 역량 구축 – 중대한 과학적 작업을 위해 미국 기반 모델에 의존하는 것은 전략적 격차를 드러냅니다. 인도의 보안 표준과 윤리 지침을 내재화한 자체 개발 모델을 구축하면 외국 세력의 영향력에 대한 노출을 줄이고 민감한 AI 역량의 흐름을 제어할 수 있습니다.
반론: 자율 규제의 필요성
Anthropic의 신속한 새로운 필터 도입은 민간 기업이 많은 입법부보다 더 빠르게 움직일 수 있음을 보여줍니다. 회사는 정부가 공식적인 규제를 논의하는 동안 자사의 '책임 있는 사용' 정책과 지속적인 레드팀 테스트가 실용적인 임시방편을 제공한다고 주장합니다. 찬성론자들은 지나치게 규제적인 법률이 특히 AI가 의학적 돌파구를 가속화하는 분야에서 혁신을 저해할 수 있다고 지적합니다. 과제는 AI가 약속하는 유익한 응용 분야를 저해하지 않으면서, 산업계의 안전장치가 투명하고 감사 가능한 수준이 되도록 균형을 맞추는 것입니다.
향후 주목해야 할 점
- 규제 움직임 – 수출 통제 기관 및 생물 보안 규제 기관의 감시가 강화될 것으로 예상되며, 이는 첨단 생성형 모델을 통제 기술로 취급하는 새로운 가이드라인으로 이어질 수 있습니다.
- 산업계 협력 – Anthropic은 위협 인텔리전스를 공유하기 위해 기존 AI 안전 연합에 참여하거나 이를 확대할 수 있으며, 이는 업계 전반에 걸쳐 이중 용도(dual-use) 시도에 대한 보고를 표준화하는 단계가 될 수 있습니다.
- 국가적 대응 – 보고서에 언급된 국가들은 개입 사실을 부인할 가능성이 높으며, 자체적인 AI 개발 프로그램을 가속화하여 방어용 AI와 공격용 AI 사용 사이의 경계를 더욱 모호하게 만드는 피드백 루프를 형성할 수 있습니다.
Anthropic의 보고서는 과학자들이 단백질 모델링을 하는 데 도움을 주는 동일한 생성 능력이 무기화될 수도 있다는 점과, 이제 AI 안전이 지정학의 영역에 정면으로 놓여 있음을 보여줍니다. 앞으로 몇 달간은 자율 규제, 정부 정책, 또는 이들을 결합한 하이브리드 방식 중 무엇이 이 기술이 갈등의 도구가 되는 것을 막을 수 있을지 시험하게 될 것입니다.
