# 영국 정부 연구 — 인기 오픈 모델 1만 개 중 보안 문서는 15개

> 영국 DSIT가 9월 7일 공개한 그리니치대 체계적 문헌 연구입니다. 오픈소스 소프트웨어와 오픈소스 AI의 보안 증거 격차, 플랫폼 분석 수치, 정부 권고 4가지를 정리했습니다.

- 출처 사이트: AI피셜 (https://aifficial.net/posts/uk-open-source-ai-security-study/)
- 발행: 2026-09-08
- 카테고리: 업계 동향 · 태그: 규제, 정책, 오픈소스, AI 보안, 영국

## 핵심 답변

영국 과학혁신기술부(DSIT)는 2026년 9월 7일 'AI 사이버 보안' 정책 모음에 그리니치대 연구진이 수행한 체계적 문헌 연구를 올렸습니다. 학술 문헌 14,561건을 걸러 43건, 회색 문헌 172건을 분석한 결과 오픈소스 AI의 훈련 데이터·가중치 배포 같은 상류 위험에 대한 증거가 거의 없다고 결론지었고, Hugging Face에서 가장 많이 내려받은 허용적 라이선스 모델 1만 개 중 보안 관련 문서를 갖춘 것은 15개(0.2%)에 그쳤습니다.

## 요약

- DCMS가 의뢰하고 그리니치대 연구진 4명이 수행한 독립 연구로, 영국 정부 정책을 대표하지 않는다고 명시돼 있습니다.
- PRISMA 방식의 병렬 체계적 검토 두 건입니다. 학술 데이터베이스 8곳에서 14,561건을 걸러 43건, 회색 문헌 172건을 분석했습니다.
- GitHub에서 AI·보안 키워드를 함께 가진 저장소 약 2,000개 중 실질적 보안 내용을 담은 것은 131개(약 6%), Hugging Face 상위 1만 개 모델 중 보안 문서가 있는 것은 15개(0.2%)였습니다.
- 권고는 정의 확립, AI BoM 등 출처 표준 주도, 플랫폼 운영자와의 거버넌스 협의, 국제 표준 참여 네 가지입니다.

## 핵심 사실

| 항목 | 값 |
|---|---|
| 공개일 | 2026-09-07 (GOV.UK, DSIT 'AI cyber security' 모음) |
| 수행 기관 | University of Greenwich (DCMS 의뢰, 독립 연구) |
| 학술 문헌 | 14,561건 → 43건 (데이터베이스 8곳, PRISMA 선별) |
| 회색 문헌 | 172건 (사이버 당국·표준 기구·국제기구·커뮤니티) |
| Hugging Face 분석 | 10,000개 중 15개 (0.2%) (허용적 라이선스 상위 다운로드 모델 중 보안 문서 보유) |
| GitHub 분석 | 약 2,000개 중 131개 (약 6%) (AI·보안 키워드 저장소 중 실질적 보안 내용) |


## 무슨 일인가요

영국 과학혁신기술부(DSIT)가 9월 7일 GOV.UK의 "AI cyber security" 정책 모음을 갱신하면서 연구 보고서 한 편을 추가했습니다. 제목은 "A study of cybersecurity literature on open-source software and AI"이고, 문화미디어스포츠부(DCMS)가 의뢰해 그리니치대 연구진 4명(Srinidhi Vasudevan, Anna Piazza, Guru Krishna Ramakrishnan, Guido Conaldi)이 수행했습니다.  게시물은 이 보고서가 독립 연구이며 영국 정부 정책을 대표하지 않는다고 못 박고 있습니다. 

방법은 PRISMA 틀을 따른 병렬 체계적 검토 두 건입니다. 학술 데이터베이스 8곳에서 2020년 이후 문헌 14,561건을 걸러 43건을 남겼고, 국가 사이버 보안 당국·표준 기구·국제기구·오픈소스 커뮤니티가 낸 회색 문헌 172건을 따로 검토했으며, 여기에 GitHub와 Hugging Face 플랫폼 분석을 더했습니다. 





## 숫자로 보면



보고서는 상용 코드베이스의 96%에 오픈소스 구성 요소가 들어가며, Log4Shell(2021)과 XZ Utils 백도어(2024)가 거버넌스 공백을 드러냈다는 배경에서 출발합니다.  플랫폼 분석에서는 GitHub에서 AI와 보안 키워드를 함께 가진 저장소 약 2,000개 가운데 두 영역을 실질적으로 다루는 것이 131개(약 6%)에 그쳤고, Hugging Face에서는 가장 많이 내려받은 허용적 라이선스 모델 1만 개 중 보안 관련 문서를 갖춘 것이 15개(0.2%)였습니다. 

| 주제 | 보고서의 진단 |
| --- | --- |
| 정의 불일치 | 코드 접근·오픈 웨이트·공급망 세 가지 틀이 경쟁, 2024년 10월 OSAID는 데이터 정보·코드·파라미터를 모두 요구 |
| 상류 위험 공백 | 침입 탐지 같은 하류 위험 연구는 많지만 훈련 방식·데이터·가중치 배포는 거의 다루지 않음 |
| 오픈 워싱 | Llama 2·Grok·Phi-2·Mixtral은 OSAID 미충족, 완전 충족은 Pythia·OLMo·Amber·CrystalCoder·T5 다섯 개 |
| 위험 프로필 차이 | OSS는 의존성 혼동·악성 주입 등 대응이 성숙, OSAI는 데이터 오염·가중치 변조·불안전한 파인튜닝·출처 부재 |
| 대응 성숙도 격차 | OSS에는 SBOM·시큐어 바이 디자인·취약점 공개가 있지만 OSAI에는 상응하는 기반이 없음 |

표의 내용은 보고서가 정리한 다섯 가지 핵심 주제입니다.  특히 훈련 데이터 필터링이 사후 훈련 방어보다 10배 넘게 효과적이지만 가중치 공개 전에만 가능하며, 공개 재배포 이후에도 유효한 유일한 개입 지점이라는 대목이 눈에 띕니다.  EU AI Act에서 오픈소스 지위가 면제 조건이 되므로, 정의가 흔들리면 거버넌스 위험으로 이어진다는 지적도 있습니다. 

## 정부에 무엇을 권고했나요



네 가지 권고는 모두 보고서 본문에 그대로 있는 내용입니다. 

## 무엇을 보면 되나요

이 보고서는 정책이 아니라 정책의 "근거 자료"입니다. 다만 영국 정부가 2025년 1월 AI 사이버 보안 실천 규범을 낸 뒤 같은 모음에 연구 자료를 계속 쌓고 있다는 점에서, 오픈 웨이트 모델의 문서·출처 의무를 다루는 후속 조치의 방향을 미리 보여 주는 자료로 읽을 수 있습니다. 


이 연구에서 정책 담당자보다 개발자가 먼저 봐야 할 숫자는 "10,000개 중 15개"입니다. 모델 카드에 보안 관련 항목을 적는 관행이 사실상 없다는 뜻이고, 보고서가 플랫폼 운영자를 직접 겨냥한 이유이기도 합니다. 한국에서도 오픈 웨이트 모델을 제품에 넣는 팀이라면 훈련 데이터 출처와 파인튜닝 이력을 스스로 기록해 두는 편이, 나중에 AI BoM 같은 요구가 왔을 때 비용을 줄이는 길이라고 봅니다. 다만 학술 문헌 43건이라는 좁은 표본에서 나온 결론이므로 "증거가 없다"를 "위험이 없다"로 읽어서는 안 됩니다. 



## 자주 묻는 질문

**Q. 이 문서는 영국 정부의 공식 정책인가요?**

아닙니다. GOV.UK 게시물은 이 보고서가 독립 연구이며 영국 정부 정책을 대표하지 않는다고 명시합니다. 다만 DSIT의 'AI cyber security' 정책 모음에 연구 자료로 편입돼 있어 이후 정책 논의의 근거 자료로 쓰일 가능성이 있습니다.

**Q. '오픈 워싱'이 무슨 뜻인가요?**

보고서는 오픈소스라고 널리 불리는 모델 가운데 Llama 2, Grok, Phi-2, Mixtral이 2024년 10월 공개된 오픈소스 AI 정의(OSAID)를 충족하지 못하며, 이를 완전히 충족하는 모델은 Pythia, OLMo, Amber, CrystalCoder, T5 다섯 개뿐이라고 적었습니다. EU AI Act에서 오픈소스 지위가 면제 조건이 되기 때문에 거버넌스 위험이 생긴다는 지적입니다.

**Q. 오픈소스 AI 보안에서 무엇이 가장 효과적이라고 하나요?**

보고서는 훈련 데이터 필터링이 사후 훈련 방어보다 10배 넘게 효과적이라는 문헌을 인용하면서, 이 조치는 가중치 공개 전에 이뤄져야 하며 공개 재배포 이후에도 살아남는 유일한 개입 지점이라고 설명합니다.

## 출처

1. [A study of cybersecurity literature on open-source software and AI (GOV.UK 게시물)](https://www.gov.uk/government/publications/a-study-of-cybersecurity-literature-on-open-source-software-and-ai) (official)
2. [같은 보고서 HTML 전문 (GOV.UK)](https://www.gov.uk/government/publications/a-study-of-cybersecurity-literature-on-open-source-software-and-ai/a-study-of-cybersecurity-literature-on-open-source-software-and-ai) (official)
3. [AI cyber security 정책 모음 (GOV.UK, DSIT)](https://www.gov.uk/government/collections/ai-cyber-security) (official)

_이 문서는 AI피셜 편집부가 작성했습니다. 인용 시 출처를 표기해 주세요._