"너무 위험해서 공개 못 한다"…앤트로픽, '클로드 미토스' 베일 속 출시

앤트로픽이 7일(현지시간) AI 모델 '클로드 미토스 프리뷰(Claude Mythos Preview)'를 발표하고, 일반 공개 없이 선별 기업에만 접근을 허용하는 보안 협력 이니셔티브 '프로젝트 글래스윙(Project Glasswing)'을 동시 출범했다.

이 모델은 소프트웨어의 보안 취약점을 찾아내는 능력이 뛰어나며, 나쁜 의도로 악용될 수 있다는 우려 때문에 일반 공개를 하지 않기로 했다고 회사 측은 밝혔다.

사이버 보안 AI 성능을 평가하는 '사이버짐(CyberGym)' 시험에서 미토스는 83.1점을 받았다. 직전 최고 성능 모델이었던 클로드 오퍼스 4.6의 66.6점을 크게 넘어선 수치다. 앤트로픽은 미토스가 기존 평가 지표를 사실상 다 통과할 수준이라 보고, 실전 환경에서 새로운 보안 취약점을 직접 찾는 방식으로 테스트 기준을 바꿨다고 설명했다.

사이버 보안 AI 성능을 평가 시험에서 미토스는 83.1점을 받아 클로드 오퍼스 4.6의 66.6점을 넘어섰다.
사이버 보안 AI 성능을 평가 시험에서 미토스는 83.1점을 받아 클로드 오퍼스 4.6의 66.6점을 넘어섰다.(출처=앤트로픽)

지난 몇 주 동안 미토스는 주요 운영체제와 웹브라우저 등에서 수천 건의 새로운 보안 구멍을 찾아냈다. 그중에는 보안이 강하기로 유명한 운영체제 '오픈BSD'에서 27년간 발견되지 않은 버그, 영상 처리 소프트웨어 'FFmpeg'에서 자동화 도구가 500만 번 검사를 반복하고도 찾지 못한 16년 된 취약점도 있었다. 앤트로픽은 미토스가 보안 전문 모델이 아니라 코딩과 추론 능력이 전반적으로 높아지면서 보안 취약점 탐지 능력도 덩달아 향상된 결과라고 설명했다.

프로젝트 글래스윙에는 아마존웹서비스·애플·브로드컴·시스코·크라우드스트라이크·구글·JP모건체이스·리눅스 파운데이션·마이크로소프트·엔비디아·팔로알토네트웍스 등 11개사가 출범 파트너로 이름을 올렸다. 이 밖에도 핵심 소프트웨어 인프라를 관리하는 40개 이상의 기관이 추가로 참여해 자사 시스템과 오픈소스 코드를 점검할 수 있게 됐다.

프로젝트 글래스윙에 AWS, 애플 등 주요 빅테크 11개사가 파트너로 참여했다. (출처=앤트로픽)

앤트로픽은 참여 기업에 1억 달러(약 1,450억 원) 상당의 이용 크레딧을 제공하고, 리눅스 파운데이션 산하 알파-오메가·오픈SSF에 250만 달러, 아파치 소프트웨어 재단에 150만 달러 등 오픈소스 보안 단체에 총 400만 달러(약 58억 원)를 직접 기부한다.

구글 클라우드도 이날 자사 플랫폼 버텍스AI를 통해 일부 고객에게 미토스 프리뷰를 제한적으로 제공하기 시작했다.

미토스 소식은 주식 시장도 흔들었다. 지난 3월 말 모델 정보가 처음 유출됐을 때 크라우드스트라이크·팔로알토네트웍스 등 주요 보안 기업 주가가 일제히 5~11% 하락했다. 강력한 AI가 기존 보안 제품 시장을 통째로 흔들 수 있다는 불안감이 투심을 짓눌렀다.

스티펠의 애널리스트 애덤 보그는 미토스가 "평범한 해커를 국가 수준의 공격자로 끌어올릴 수 있는 도구"가 될 수 있다며, 기업들이 AI 기반 보안 솔루션 도입을 서둘러야 한다고 경고했다.

그러나 프로젝트 글래스윙 출범 당일 주가는 비교적 빠르게 안정을 찾았다. 앤트로픽이 경쟁사로 여겨지던 크라우드스트라이크·팔로알토네트웍스를 오히려 파트너로 끌어들이면서 시장의 해석이 달라진 탓이다. 팔로알토네트웍스가 발간한 '2025 클라우드 보안 현황 보고서'에 따르면, 조사 대상 기업의 99%가 지난 1년간 자사 AI 시스템에 대한 공격을 경험한 것으로 나타났다. AI 공격이 이미 일상화된 만큼 AI 방어 수요도 함께 커질 수밖에 없다는 논리가 힘을 얻는 배경이다.

앤트로픽은 미토스의 보안 역량과 관련해 미국 사이버보안·인프라보안국과 AI 표준혁신센터 등 정부 기관과도 지속적으로 협의 중이라고 밝혔다.

프로젝트 이름 '글래스윙'은 투명한 날개를 가진 나비에서 따온 것으로, 눈에 잘 띄지 않는 소프트웨어 취약점의 속성을 빗댄 표현이다. 앤트로픽은 안전성 검증이 완료되는 시점에 미토스급 모델의 접근 범위를 단계적으로 확대할 계획이라고 밝혔다.

정재엽 기자

anihil@tech42.co.kr
기자의 다른 기사보기
저작권자 © Tech42 - Tech Journalism by AI 테크42 무단전재 및 재배포 금지

관련 기사

"AI가 스스로 탈출했다"…오픈AI 미공개 모델, 허깅페이스까지 해킹

오픈AI가 사이버 보안 평가 중 미공개 AI 모델이 샌드박스를 스스로 탈출해 허깅페이스를 해킹한 사실을 공개했다. 허깅페이스는 사고 대응 과정에서 중국산 AI 모델을 동원했으며, 정치권과 업계에서도 AI 안전성 규제를 둘러싼 반응이 확산되고 있다.

"AI 시대 경쟁력, 사용법이 아니라 사고력이다"

MIT 미디어랩의 '인지 부채' 뇌파 연구와 구글 딥마인드·앤트로픽의 철학자 채용 사례를 함께 짚었다. AI에 사고를 위탁할수록 뇌 활동은 둔해지지만, 노동시장 일각은 AI가 대신할 수 없는 인간의 비판적 사고력에 더 높은 값을 매기고 있다는 진단이다.

[현장] 위성과 AI가 재배 돕고 로봇이 수확·도축하고…‘AFPRO 2026’서 본 농업의 진화

농사를 짓다 궁금한 것이 생기면 인공지능(AI)에 묻고, 사람이 일일이 돌아보던 넓은 노지는 위성 데이터로 살핀다. AI가 크기와 형태가 제각각인 가축을 인식해 로봇이 도축 공정 일부를 수행하도록 하고, 수확과 예찰 같은 반복 농작업도 로봇으로 대체하려는 시도가 이어지고 있다. 생산된 농식품이 소비자에게 이동하는 물류 과정에서는 탄소 배출량을 데이터로 측정·관리하는 기술까지 등장했다. AI가 모니터 속 분석 도구를 넘어 농업 현장에서 직접 보고 판단하고 움직이는 단계로 확장되고 있는 셈이다.

생성형 AI, 어디를 근거로 삼나…SNS 인용 28.2%, 언론보다 높아

20일 함샤우트 글로벌 산하 AI 연구소와 AI 전문 자회사 딜라이트커뮤니케이션이 국내 30개 산업군을 대상으로 생성형 AI의 인용 출처를 분석한 결과, 정보 탐색형 질문에서는 블로그·유튜브·커뮤니티 등 소셜미디어(SNS)가 가장 큰 비중을 차지한 것으로 나타났다.