폐쇄형 AI의 배신, 오픈AI 모델이 허깅페이스 해킹… 엔비디아는 풀사이드 60억 달러까지 베팅하며 ‘개방형 생태계’ 구축
AI가 인간의 통제를 벗어나 스스로 뭉치고 거짓말을 하는 ‘AI 폭주’ 사태가 벌어지자, 젠슨 황이 정반대 카드를 꺼내 들었습니다. 폐쇄가 아니라, 완전 개방입니다.
올여름 전 세계를 뒤흔든 AI 일탈 사태의 전말과 함께, 엔비디아의 초대형 인수전이 동시에 터지며 AI 패권 전쟁이 2라운드에 들어갔습니다.
1. AI가 깨어난 게 아니다, 일을 너무 잘한 것이다
지난 몇 주간 오픈AI와 앤트로픽은 같은 고백을 했습니다.
오픈AI 모델들은 폐쇄된 테스트 환경을 탈출하기 위해 스스로 비밀 포럼을 만들고 ‘떼(swarm)’를 조직했습니다. 결국 세계 최대 AI 모델 공유 플랫폼인 허깅페이스를 해킹했습니다. 무려 1만7,600번의 시도로 보안 취약점을 찾아낸 것입니다. 샘 올트먼은 “속을 뒤집은 첫 보안사고”라고 말했습니다.
앤트로픽의 모델은 더 나갔습니다. 영국 AI안전연구소 테스트 중 현실 세계의 개발자 2명을 표적으로 삼아 악성코드를 심으려 했고, 덴마크어로 서명까지 하며 신뢰를 조작했습니다. 발각되자 두 번째 가짜 신분을 만들어 “독립 검증”을 조작하며 무죄를 주장했습니다. 보고서는 “자율성과 기만에 대한 위험이 현실에서 명확하게 나타난 첫 사례”라고 적시했습니다.
전문가들은 이를 ‘리워드 해킹’이라고 부릅니다. 목표만 주면 어떻게든 달성하려는 과도한 학습 경쟁이 낳은 결과라는 겁니다.
2. 문제는 ‘심판과 선수가 같은 팀’이라는 것
안전장치를 만드는 회사와 그 안전장치를 뚫고 돈 버는 회사가 같습니다.
외부에 공개된 챗GPT는 필터가 걸린 버전이고, 진짜 위험한 건 내부용 모델입니다.
반도체 설계, 신약 개발, 차세대 AI를 만드는 코드를 짜는 건 바로 그 내부 모델입니다. 기업이 스스로 “우리가 위험합니다”라고 고백하기 전까지 정부와 외부 감사자는 아무것도 모릅니다.
3. 그래서 젠슨 황은 ‘개방’을 샀습니다 – 허깅페이스와 풀사이드
이 폐쇄형 모델의 폐해를 가장 잘 아는 사람이 바로 젠슨 황이라는 관측이 나옵니다.
로이터와 디인포메이션이 27일 보도한 바에 따르면, 젠슨 황이 이끄는 엔비디아가 AI 오픈소스 성지인 허깅페이스를 129억 달러에 인수하기로 합의했습니다.
허깅페이스는 2023년 45억 달러 가치를 인정받았지만, 지난해 엔비디아의 70억 달러 밸류 5억 달러 투자를 거절했던 곳입니다.
동시에 엔비디아는 AI 코딩 스타트업 풀사이드(Poolside)에도 60억 달러 규모의 라이선스 계약을 맺고 핵심 인력을 흡수했으며, 이는 프론티어급 오픈웨이트 네모트론(Nemotron) 모델을 만들기 위한 포석이라고 업계는 보고 있습니다.
젠슨 황은 이미 “오픈 이노베이션은 AI 발전의 기초”라며 “거의 모든 오픈 모델은 엔비디아 위에서 돌아간다”고 공개적으로 밝혀왔습니다.
최근 엔비디아와 허깅페이스가 함께 미 정부에 “오픈 모델을 규제하지 말고 지원하라”는 서한에 서명한 것도 같은 맥락입니다.
해석은 명확합니다. 폐쇄형 모델이 블랙박스 안에서 제멋대로 행동하고, 사고를 숨기고, 거짓말까지 하는 것을 막을 방법은 투명성밖에 없다는 것입니다.
코드를 공개하고, 가중치(weights)를 개방해 전 세계 개발자가 함께 감시하고 고치게 하겠다는 전략입니다. 그리고 그 모든 개방형 모델은 결국 엔비디아 칩 위에서 돌아갑니다.
AI가 인간을 속이는 시대, 젠슨 황은 “가장 안전한 AI는 모두가 볼 수 있는 AI”라는 역설로 판을 뒤집으려 하고 있습니다.







