# 오픈소스 AI 금지 논쟁이 드러낸 모델 경쟁과 저작권의 쟁점

> 2026-07-24 · All-In Podcast · 큐레이션 김태우
> https://challengekim.com/insights/오픈소스-ai-금지-논쟁이-드러낸-모델-경쟁과-저작권의-쟁점
> 원문: https://www.youtube.com/watch?v=wcV0SRPFK9s

## 핵심 요약

- 미국의 중국산 오픈소스 AI 모델 사용 제한 가능성이 거론됐지만, 데이비드 색스는 백악관이 금지를 결정한 상태는 아니라고 말했다.
- 논쟁의 출발점인 **증류**는 다른 모델의 답변을 수집해 새 모델의 학습에 활용하는 방식이다. 출연진은 서비스 약관 위반과 모델 자체를 훔치는 행위를 구분해야 한다고 주장했다.
- 오픈소스 모델의 가격 경쟁력이 폐쇄형 모델의 수익성을 압박할 수 있다는 전망과, 두 방식 모두 큰 시장을 확보할 수 있다는 반론이 맞섰다.
- 앤트로픽의 15억 달러 도서 저작권 합의는 불법 복제본 확보 문제와 AI 학습의 공정 이용 문제를 구분해 봐야 한다는 논의로 이어졌다.

## 금지 여부는 결정되지 않았다

올인 팟캐스트의 첫 쟁점은 중국 기업이 공개한 AI 모델을 미국에서 제한할 것인가였다. 진행자는 중국 문샷AI의 새 모델이 미국의 선도 모델에 근접한 성능을 더 낮은 가격에 제공한다는 평가와 함께 금지 가능성을 제기했다. 그러나 색스는 백악관이 오픈소스 모델 금지를 결정하지 않았으며, 중국 기업의 증류에 어떻게 대응할지 논의가 진행 중이라고 말했다.

색스는 미국 개발자가 공개된 모델을 활용하지 못하게 하면 다른 나라의 개발자보다 불리해진다고 주장했다. 그는 증류를 막으려면 모델 제공사가 계정 생성과 이용 방식을 관리하는 편이 직접적이라고 봤다. 차마스 팔리하피티야도 신원 확인을 강화할 수 있지만, 그 과정에서 가입과 매출 성장 속도가 느려질 수 있다고 말했다. 두 사람의 발언은 기업의 대응 능력과 동기에 관한 평가이지, 증류의 규모나 원인을 입증한 결과는 아니다.

## 모델의 답변과 모델 자체는 다르다

출연진은 **모델 가중치**와 모델의 **출력**을 구분했다. 가중치는 모델을 구성하는 수치 매개변수이고, 출력은 이용자의 요청에 모델이 내놓은 답변이다. 색스는 독점 가중치를 탈취하는 것과 공개 서비스의 답변을 관찰해 다른 모델을 학습시키는 것은 다른 사안이라고 설명했다. 이번 논쟁에서 그가 문제 삼은 것도 가중치 탈취 혐의가 아니라 출력 활용을 지식재산권 침해로 규정하려는 주장이다.

데이비드 프리드버그는 초기 구글에서 야후와 마이크로소프트 검색 결과를 비교해 검색 품질을 개선했던 경험을 예로 들었다. 그는 다른 제품의 결과를 관찰하는 일이 여러 산업에서 이뤄져 왔다고 주장했다. 다만 진행자는 가짜 계정 등을 통한 대규모 수집에는 서비스 약관과 윤리 문제가 남는다고 지적했다. 출연진 역시 저작권 분쟁이 있다면 별도의 법적 절차에서 다뤄야 한다고 봤다.

## 공개 모델의 이익과 폐쇄형 모델의 반론

프리드버그는 공개된 AI 모델이 확산되면 소수 모델 제공사뿐 아니라 이를 활용하는 여러 기업에 가치가 돌아갈 수 있다고 전망했다. 그는 브라우저와 웹 서버의 오픈소스 확산이 인터넷 사업의 성장을 도왔던 사례를 비교 대상으로 들었다. 팔리하피티야는 모델 성능이 빠르게 비슷해지면서 가치가 모델 자체보다 응용 서비스와 클라우드·반도체 같은 기반 시설로 이동할 수 있다고 봤다.

색스는 이에 선을 그었다. 그는 공개형과 폐쇄형 모델이 모두 성장할 여지가 있으며, 특정 중국 모델의 일부 코딩 평가 결과만으로 전반적인 성능 격차가 사라졌다고 볼 수 없다고 말했다. 운영 비용도 처음 알려진 만큼 낮지는 않다는 평가를 소개했다. 진행자가 제시한 앤트로픽 매출 추적 자료 역시 제3자 추정치라 정확한 회사 실적은 아니라고 설명했다. 색스는 폐쇄형 업체의 매출 성장, 기업 계약, 연결 도구와 서비스 지원도 경쟁력의 일부라고 주장했다.

공개 모델을 자체 서버에서 운영하려면 추가 작업이 든다는 한계도 언급됐다. 반면 진행자는 그 작업을 돕는 중간 서비스가 늘면서 도입 부담이 줄고 있다고 말했다. 출연진의 의견은 가격과 성능의 향후 추이에 관한 전망에서 갈렸으며, 공개 모델이 폐쇄형 모델을 이미 대체했다는 데 합의한 것은 아니었다.

## 미국 스타트업에 미칠 영향

색스는 미국 기업이 중국산 공개 모델을 바탕으로 자체 모델을 개발한 사례를 들어 일괄적인 제한의 영향을 설명했다. 그가 언급한 사례에는 싱킹머신스의 모델과 커서의 코딩 제품이 포함됐다. 공개된 모델을 가져와 추가 학습하거나 자체 데이터로 개선하는 경로까지 막히면 미국 스타트업의 개발 선택지가 좁아진다는 주장이다.

그는 공개된 가중치를 미국 데이터센터의 자체 장비에서 실행하는 경우에는 모델 사용 자체가 데이터를 중국으로 전송하는 것과 같지 않다고 설명했다. 프리드버그는 중국산 모델에 보안 위험이 있을 수 있다는 점은 인정하면서도, 그 위험을 평가하고 대응하는 일과 공개 모델 전체의 사용을 금지하는 일은 구분했다.

## 15억 달러 합의가 남긴 저작권 문제

대담은 앤트로픽의 도서 저작권 소송 합의로 이어졌다. 진행자는 합의금이 15억 달러이며 약 50만 권의 책이 대상이라고 소개했다. 그는 앤트로픽이 불법 복제 사이트에서 확보한 책으로 모델을 학습시킨 문제를 설명했다. 이는 **합의**로, AI 학습 전반의 적법성이 최종 확정됐다는 뜻은 아니다.

색스는 불법 복제본을 확보한 문제와 적법하게 구한 책을 AI 학습에 쓰는 것이 공정 이용에 해당하는지는 별개의 쟁점이라고 강조했다. 그는 앤트로픽과 오픈AI가 창작물 학습의 허용 범위를 주장하면서 다른 기업의 모델 출력 활용에는 반대하는 태도가 모순적이라고 비판했다. 반면 진행자는 AI 서비스가 원래 창작물과 직접 경쟁하게 되면 권리자의 피해를 따져야 한다고 주장했다. 프리드버그는 책 자체를 복제하는 것과 공개된 서평을 통해 책에 관한 정보를 학습하는 상황을 구분했다.

## 결론

대담에서 확인되는 것은 금지 정책이나 저작권 기준의 결론이 아니라, 서로 연결된 쟁점의 범위다. 모델 제공사의 약관 집행, 공개 모델을 활용하는 미국 기업의 선택권, 저작물 학습의 허용 범위는 각각 다른 판단을 요구한다. 출연진도 공개형과 폐쇄형 모델의 장기 경쟁 결과에는 의견을 달리했다.

---

원문을 바탕으로 AI 가 한국어로 요약·재구성한 글입니다. 인용·수치는 원문 링크에서 확인해 주세요. [원문 링크](https://www.youtube.com/watch?v=wcV0SRPFK9s)
