Systems & Infrastructure Writer
오픈 웨이트 AI에서 불편한 점은 모델이 약하기 때문이 아니다. 오히려 모델들이 충분히 강력해져서 중요해지고 있고, 통제가 어려워 이전의 안전 담론이 무너지기 시작했다는 것이다. 공개된 평가 결과 중국의 GLM-5.2가 일부 사이버 작업에서 최첨단에 가까운 위치에 있다.[3][4] 이는 사이버 역량이 단순히 질문에 답하는 모델과 실제로 공격자가 피해를 입히는 데 도움을 줄 수 있는 모델을 구별하는 데 가장 쉬운 분야 중 하나이기 때문에 중요하다.
최근 공개 평가에서 영국의 AI 보안 연구소는 2026년 6월에 테스트한 오픈 웨이트 모델 중 GLM-5.2가 가장 사이버 역량이 뛰어나다고 밝혔다.[4] 이 연구소는 GLM-5.2가 좁은 사이버 작업에서는 Anthropic의 Opus 4.6과, 장거리 사이버 시뮬레이션에서는 Opus 4.5와 유사한 성능을 보였으며, 상위 독점 시스템과의 격차는 약 4~7개월 정도인 것으로 추정했다.[4] 같은 논쟁과 관련된 다른 평가에서 SaferAI는 해당 모델이 사이버 및 생명과학 능력 면에서 미국 주요 시스템에 비해 몇 달 정도 뒤쳐져 있다고 분석했다.[3] 이는 완전한 동등성은 아니지만 대화를 바꿀 만큼 충분히 가까운 수준이다.
중요한 것은 단순한 역량뿐만 아니라 운영 모델이다. 오픈 웨이트 시스템은 원 개발자의 개입 없이 다운로드하고 수정하며 재배포할 수 있다.[5] 이것이 기본 전제이자 문제점이다. 일단 가중치가 공개되면 마찰 지점이 모델 접근에서 모델 수정으로 바뀐다.[5][10] 호스팅 제품에서는 견고해 보이는 안전장치가 후속 사용자가 빠르고 간단한 인프라로 해제할 수 있다.
NPR은 올해 초, 안전장치가 없는 오픈 웨이트 모델은 폐쇄형 시스템보다 이러한 안전장치를 제거하기 쉬워 위험하다고 보도했다.[13][6] 이는 단순한 이론적 문제가 아니다. 누가 모델을 사용할 수 있는지, 악의적 사용자가 얼마나 빠르게 적응할 수 있는지, 방어자가 새로운 악용 패턴 확산 전에 어느 정도 경고를 받을 수 있는지가 바뀐다. 인프라 측면에서 공격 표면은 넓어지고 통제 범위는 좁아진다.
지정학적 요소는 이 문제를 더욱 복잡하게 만든다. 중국의 오픈 웨이트 모델은 미국 정책 불안을 재점화했는데, 수출 통제가 반도체와 컴퓨팅에 맞춰 설계된 반면 모델은 인터넷 속도로 복제 및 배포될 수 있다는 경고가 있었다.[3][11][8] 일부 미국 관리와 업계 인사들은 오픈 웨이트 공개를 전략적 자산으로 여기고 있다. 다른 이들은 생태계가 소수의 폐쇄형 연구소에 전적으로 의존하지 않도록 하는 수단으로 본다.[5][8] 두 시각 모두 맞지만, 역량 있는 모델이 공개된 이상 그 행동 양식은 단순한 제품 결정이 아니다.
여기에는 사업적 동기도 존재하며, 논의가 이념 논쟁에 갇히면 간과하기 쉽다. 오픈 웨이트 공개는 채택, 커뮤니티 도구, 의존성을 창출한다.[5] 또한 원 개발자가 모를 수도 있는 다양한 후속 수정자 사용자 층을 만든다.[10] 배포가 목표라면 유용하지만, 모든 분기, 미세 조정, 로컬 배포에 걸쳐 안전 제약을 유지하는 것이 목표라면 위험하다. 메타의 Llama 전략이 그 긴장 속에 있다.[5] 접근성이 기능인 Hugging Face 주변의 더 넓은 오픈소스 생태계도 마찬가지다.[5][13]
이 모델들의 실제 남용 빈도가 정확히 확인된 것은 아니다. 공개 평가는 모델이 통제된 환경에서 공격적 사이버 또는 이중용도 작업을 완료할 수 있음을 보여줄 수 있다.[1][3][4][9] 그러나 이 역량이 실제 생산 네트워크나 범죄적 워크플로에서 얼마나 자주 사건으로 이어지는지는 입증하지 못한다.[2][7][9] 판단을 바꿀 증거는 명확하다: 오픈 웨이트 모델이 침입, 피싱, 악성코드 개발, 바이오 등 오용 비용을 규모 있게 실질적으로 낮춘 반복적이고 명확한 사례들이다. 그런 증거 없이는 사안이 심각하지만 부분적으로 추론에 의존한다.
RAND는 오픈 웨이트 모델이 확산됨에 따라 컴퓨팅 등 핵심 노드의 엄격한 모니터링과 더 강력한 방어용 사이버 역량이 정당화될 수 있다고 주장했다.[2][7][12] 우아해 보이진 않지만 인프라 문제는 대개 그렇지 않다. 모델 가중치를 소프트웨어처럼 이동할 수 있다면, 현실적인 통제 지점은 배포, 컴퓨팅 접근, 평가, 출시 후 모니터링이 될 수밖에 없다. 이들 모두를 전 세계적으로 강제하는 것은 쉽지 않다.
더 근본적인 문제는 오픈 웨이트가 곧 오픈 세이프티가 아니라는 점이다. 전자는 배포를 확장하지만 후자는 아직 그렇게 확장되지 않는다. 모델이 문서화된 제한조건과 함께 공개될 수 있지만, 충분한 동기와 기술을 가진 누구라도 몇 시간 내에 그 제한을 해제할 수 있다.[13][10][5] 이 비대칭이 핵심이다. 개발자들은 공유 혁신의 혜택을 얻고, 나머지 모두는 더 쉬운 악용의 단점을 짊어지며, 방어자들은 선택하지 않은 움직이는 표적에 대응해야 한다. 신뢰와 선의만으로는 좋지 않은 거래다. 산업계가 공개를 감독의 시작으로 보고 끝이 아니라면 관리 가능한 거래가 될 수 있다. 다음에 주목할 부분은 공개 평가가 안전 통제보다 역량 격차를 더 빨리 좁혀 가는지 여부인데, 이것이 오픈 웨이트 AI가 단순한 엔지니어링 선택인지 보안 리스크인지 결정할 것이다.
참고 소스
참고 소스
본문의 작은 번호 태그는 아래 참고 소스와 연결됩니다.
- UK Warns Open-Weight AI Cyber Models Are Closing the Gap With Frontier Systems | Mallory
- Strengthening Emergency Preparedness and Response for AI Loss of Control Incidents
- Open-weight AI models are catching up to the frontier. ...
- How Far Behind the Frontier are Leading Open Weight Models on Cyber?
- How will AI influence US-China relations in the next 5 years?
- OpenAI blamed a hacking event on its AI models gone ...
- Legal and Policy Approaches to Mitigate Catastrophic ...
- OpenAI is scared of open-weight models. Should the US be?
- Mitigating Cyber Risk in the Age of Open-Weight LLMs: Policy Gaps ...
- Understanding the Risks of Open-Source AI
- China’s use of open‑source AI threatens the US lead in AI development, US Commission warns – Computerworld
- Mitigating Cyber Risk in the Age of Open-Weight LLMs: Policy Gaps...
- These AI models are free, private, and will never say 'no'
추천 기사
추천 기사
-
생성형 AI와 파운데이션 모델
후지TV의 흔들림은 영상 산업의 골격이 바뀌는 신호일지도 모른다
후지TV를 둘러싼 위기를 단순한 불미스러운 사건으로 보는 것이 아니라, TV 광고 감소, 시청시간 분산, YouTube와 VOD의 부상, 그리고 생성 AI에 의한 영상 제작의 민주화라는 복합 구조 변화로 읽기 위한 장기 보존형 기사다. 방송국의 거버넌스 문제와 영상 산업의 가치 장소를 연결한다.
-
생성형 AI와 파운데이션 모델
싱가포르가 AI 중립지대로 거듭나려는 이유와 진짜 시험대
본 기사는 싱가포르의 국가 AI 전략 업데이트, 현지 확장하는 다국적 기술기업들의 연구개발 및 지역 본부 구축, 그리고 미국 연구기관의 ‘중립 AI 허브’ 평가를 출발점으로, 미국과 중국 사이에서 협력과 실현이 가능한 AI 생태계를 설계하는 이 도시국가의 전략을 살핀다. 정책, 클라우드 인프라, 자본 흐름과 기업 입지 논
-
생성형 AI와 파운데이션 모델
중남미, 인공지능으로 낡은 경제를 뛰어넘다
중남미가 인공지능을 단순한 소프트웨어 계층이 아니라, 아날로그 방식으로 작동하는 산업을 재설계하는 도구로 인식하는 단계에 접어들었다.