- 위험한 능력이 없는 오픈 웨이트 모델은 기업·개발자·연구자에게 가치를 제공하는 공공재이며, Anthropic은 이를 범주 전체로 금지하는 데 반대함
- 핵심 국가안보 우려는 공개 방식 자체가 아니라 권위주의 정부의 AI 우위, 강력한 모델을 이용한 사이버·생물학 공격과 정렬 문제임
- 오픈 웨이트는 안전장치 적용과 사용 감시가 어렵고 배포 후 회수할 수 없어 위험이 커질 수 있지만, 미국 기업의 사용을 금지해도 악의적 행위자를 막기 어려움
- 대안으로 중국에 대한 고성능 칩·제조 장비 수출 차단, 산업 규모 증류 단속, 공개·비공개 모델을 포괄하는 능력 기준의 의무 안전성 테스트를 지지함
- 오픈 웨이트가 방어자에게 유리하다고 미리 단정하지 말고, 특히 생물학의 공격자·방어자 비대칭을 포함한 위험을 출시 전 실증 테스트로 판단해야 함
오픈 웨이트 전면 금지에 반대하는 이유
- 일부 미국 관리가 미국 기업의 중국산 오픈 웨이트 모델 사용 금지를 검토한다는 보도 이후, 여러 기술 기업이 오픈 웨이트를 지지하는 공개서한에 서명함
- Anthropic은 사업 보호를 위해 금지를 원한다는 비판을 부인하며, 오픈 웨이트 모델이라는 범주 전체를 금지하자고 주장한 적이 없다고 밝힘
- 위험한 능력이 없는 오픈 웨이트 모델은 실행에 필요한 컴퓨팅 비용 외에 별도 비용 없이 기업·개발자·연구자에게 가치를 제공하는 공공재임
- 보호주의적 금지는 주요 국가안보 위협을 해결하지 못한 채 미국 AI 기업을 경쟁으로부터 보호하는 효과만 낼 수 있음
두 가지 국가안보 위협
-
권위주의 정부의 AI 우위
- 가장 큰 우려는 중국공산당(CCP)을 포함한 권위주의 정부가 미국보다 강력한 AI 모델을 개발해 영구적인 군사적 우위를 확보하거나 자국민을 극도로 억압하는 데 사용하는 상황임
- 중국공산당만이 유일한 위협은 아니지만, 권위주의 정부 가운데 가장 강력한 위협으로 평가함
- 미국 정부도 같은 문제를 우려하고 있음
- Vance 부통령은 권위주의 정권이 AI를 탈취·사용해 군사·정보·감시 역량을 강화했다고 경고함
- 2026년 연례 위협 평가는 다른 강대국의 AI 발전이 미국의 경제 경쟁력과 국가안보 우위를 위협한다고 판단함
- 이 위협에서는 모델이 오픈 웨이트인지, 미국 기업이 사용하는지 여부가 중요하지 않음
- 가장 위험한 모델은 비밀리에 훈련된 뒤 인민해방군의 드론이나 국가안전부의 감시·억압에만 제공되는 모델일 수 있음
-
사이버·생물학 공격과 정렬 문제
- 두 번째 우려는 강력한 AI 모델이 사이버·생물학 공격에 악용되거나 심각한 정렬 문제를 일으키는 상황임
- 출신 국가와 관계없이 오픈 웨이트 모델은 비공개 모델보다 잠재적 위험이 더 클 수 있음
- 오픈 웨이트에는 안전장치를 적용하거나 사용 행태를 감시하기가 매우 어려움
- 웨이트가 공개되면 회수할 수 없으며 안전장치도 제거할 수 있음
- 복사본을 내려받아 재배포하거나 감시할 수 없는 사설 시스템에서 실행하는 것도 가능함
- UK AI Security Institute 보고서는 위험한 능력을 가진 오픈 웨이트 모델의 공개가 지속적이고 되돌릴 수 없는 오용 위험을 만든다고 평가함
- 미국의 합법적인 기업이 악의적 행위자일 가능성은 낮으므로, 미국 기업의 모델 사용을 금지해도 이러한 위험을 직접 막지 못함
고성능 칩과 제조 장비 통제
- 중국에 고성능 칩과 칩 제조 장비를 판매하지 않고, 칩 확보에 동원되는 밀수와 우회 경로를 단속해야 함
- 중국의 국내 생산 능력은 제한적이며, 스케일링 법칙에 따라 미국산 칩 없이 미국보다 강력한 모델을 만들 수 없다는 판단임
- 칩 통제는 권위주의 정부가 미국보다 강력한 모델을 만드는 첫 번째 위협을 가장 효율적이고 직접적으로 차단함
- 미국 법률의 범위 밖에서 강력한 모델을 훈련하기 어렵게 만들어 사이버·생물학 공격과 정렬 위험도 간접적으로 줄일 수 있음
- 미국 법무부는 중국으로 첨단 AI 기술을 불법 반출하거나 밀수하려 한 여러 사건을 공개했으며, Anthropic은 이러한 밀수와 우회 수단에 대한 단속 강화를 요구함
산업 규모 증류 단속
- 모델 증류는 처음부터 모델을 훈련하는 것보다 컴퓨팅 효율이 높아, 중국이 보유한 칩 규모로 가능한 수준보다 나은 모델을 만들고 칩 통제를 일부 우회하게 함
- 증류만으로 중국공산당이 미국과 동등하거나 우월한 AI 역량을 얻을 수는 없지만, 중국의 프런티어 모델을 미국보다 불과 수개월 뒤진 수준까지 끌어올릴 수 있음
- 증류 기업 다수가 오픈 웨이트 모델을 공개하더라도 핵심은 공개 방식이 아니라, 미국의 프런티어를 추월하려는 권위주의 국가가 산업 규모의 작업을 지원한다는 점임
- 전면적인 오픈 웨이트 금지 대신 증류를 억제할 표적화된 정책·법률·상업 체계가 필요함
- Anthropic도 자사 모델을 대규모 증류에 사용하는 계정을 식별해 차단함
- 상당한 증류가 진행된 뒤에야 관련 계정을 찾아내는 경우가 있음
- 다수의 가짜 계정이 계속 생성돼 단속 대상도 끊임없이 바뀜
- 개별 기업의 조치만으로는 해결하기 어려워 정책 개입이 필요함
능력 기준의 의무 안전성 테스트
- 충분히 강력한 모든 모델은 공개·비공개 여부와 출신 국가에 관계없이 출시 전에 사이버·생물학·정렬 위험 테스트를 받아야 함
- Trump 행정부가 최근 이 방향으로 움직였으며, 업계 제안도 가장 강력한 모델에 동일한 테스트를 적용하는 방안을 포함함
- 스타트업과 학계가 개발한 능력이 낮은 모델은 의무 테스트 대상에서 완전히 제외할 수 있음
- 오픈 모델의 위험이 실제로 더 큰지, 그 위험을 완화할 수 있는지는 사전에 단정하지 않고 테스트 결과로 판단해야 함
- Anthropic의 모듈식 훈련 전략 연구처럼 오픈 웨이트 모델의 안전성을 높일 가능성이 있는 방법도 존재함
- 효과적인 안전성 테스트에는 국제적 적용이 필요하므로 중국공산당의 참여도 요구됨
- AI 생물학 무기 방지는 중국에도 이익이 될 수 있어 이 분야에서는 제한적인 협력이 가능하다고 봄
오픈 웨이트 공개서한과의 차이
- Anthropic은 오픈 웨이트와 미국 AI 리더십 공개서한의 일부 내용에 동의함
- 오픈 웨이트는 AI 경제에 대한 접근성을 확대함
- 일부 활용 사례에서 경쟁을 강화함
- 고객에게 더 큰 통제권을 부여함
- 증류 문제는 전면 금지가 아닌 표적화된 법률·상업 체계로 다뤄야 함
- 다만 오픈 웨이트가 반드시 안전장치 개발을 쉽게 만들거나, 광범위한 능력 접근이 공격자보다 방어자에게 유리하다는 전제에는 동의하지 않음
- 실제로는 광범위한 접근이 공격자에게 더 유리할 수도 있으므로, 어느 쪽이 우세한지 실증적으로 검증해야 함
생물학의 공격자·방어자 비대칭
- 충분히 강력한 모델은 널리 구할 수 있는 재료로 팬데믹 수준의 바이러스를 빠르게 무기화할 수 있지만, 이에 대한 방어는 최상의 경우에도 수년이 걸리는 운영 과제가 될 수 있음
- Operation Warp Speed 사례처럼 대응 기술과 체계를 마련하는 데 긴 시간이 필요하므로 생물학에서는 강한 공격자 우위가 존재할 수 있음
- 현재 생물학적 재앙을 막는 요인은 방어자나 재료의 제한보다 지적 능력과 파국적 피해를 일으키려는 의도 사이의 음의 상관관계라고 봄
- 인터넷 검색이나 DNA 합성과 같은 이전 기술은 이 상관관계를 깨뜨릴 만큼 강력하지 않았지만, AI는 현재 발전 속도라면 곧 이를 무너뜨릴 수 있다는 우려가 있음
- 충분히 강력한 기술이 모든 장벽을 제거하면 공격자와 방어자 중 어느 쪽에 구조적 우위가 있는지가 드러나며, 생물학에서는 공격자가 우세할 수 있음
- 이러한 위험은 추정이나 공개 방식에 대한 선입견이 아니라 엄격한 출시 전 테스트로 판단해야 함
Anthropic이 요구하는 정책
- 오픈 웨이트 모델을 하나의 범주로 묶어 금지하지 않음
- 권위주의 정부가 고성능 칩과 제조 장비를 확보하지 못하도록 수출·밀수 통제를 강화함
- 산업 규모의 모델 증류를 법률·상업·정책 수단으로 차단함
- 충분한 능력을 갖춘 모든 공개·비공개 모델에 사이버·생물학·정렬 위험 테스트를 의무화함