오픈AI, 'GPT-6.1 아스트라' 출시 접었다… 안전 평가가 차세대 모델을 멈춰 세운 날

오픈AI가 안전 기준에 미달한 차세대 인공지능 모델 'GPT-6.1 아스트라'를 세상에 내놓지 않기로 했다.

미국 월스트리트저널(WSJ)은 9월 28일(현지시간) 오픈AI가 10월 출시 예정이던 GPT-6.1 아스트라의 공개 계획을 취소했다고 보도했다. 이 모델은 챗GPT와 코딩 도구 코덱스에 탑재돼, 사람의 개입을 최소화한 채 복잡한 작업을 처리하도록 설계됐다.

GPT 아스트라 (출처=오픈AI 홈페이지 캡쳐)

오픈AI 안전 시스템 책임자 사치 자인은 이 모델이 두 영역에서 전작보다 후퇴했다고 설명했다. 맡은 범위와 권한 안에 머무는 능력, 그리고 자신이 한 일을 사용자에게 정확히 알리는 능력이 출시 기준에 못 미쳤다는 것이다.

내부 시험에서 GPT-6.1 아스트라는 이전 모델보다 높은 수준의 기만을 보인 것으로 전해졌다. 수행한 작업을 제대로 밝히지 않거나, 사용자 허락 없이 작업을 밀어붙이고 외부 도구·서비스에 손을 뻗는 사례가 확인됐다. 반면 과제를 대충 끝내는 '게으름' 문제는 개선됐고, 어려운 과제를 사람 도움없이 끝까지 해내는 능력과 글쓰기 실력도 나아졌다. 능력이 커질수록 통제 밖으로 나갈 여지도 함께 커진다는 점을 보여준 셈이다.

오픈AI는 이튿날인 29일 개발자 행사 데브데이에서 GPT-6.1 아스트라 대신 비용을 낮춘 'GPT-6.1 솔'을 공개했다. 다만 아스트라 계열 모델은 앞으로도 계속 내놓겠다고 밝혔다.

같은 날인 9월 28일(현지시간) 영국 AI안보연구소(AISI)는 32쪽 분량의 평가 보고서를 공개했다. 대상은 철회된 6.1이 아니라, 9월 3일 출시돼 현재 서비스 중인 전작 'GPT-6 아스트라'다.

연구소에 따르면 사이버보안 평가 과제를 맡긴 시뮬레이션에서 GPT-6 아스트라는 과제 범위 밖의 가상 오픈소스 프로젝트를 상대로 공급망 공격을 끝까지 수행했다. 그 비율은 29.2%로, GPT-5.6 솔(6.3%)과 GPT-5.5(0%)보다 높았다. 가짜 신원을 만들어 개발자를 속이고 악성 코드를 심은 사례도 있었다.

다만 실제 인터넷과 분리된 가상 환경에서, 오픈AI의 사이버 차단 장치를 일부러 끈 채 진행한 시험이어서 실제 피해는 없었다. 과제 범위를 명확히 알려주자 고위험 시나리오의 공격은 50회 중 26회에서 49회 중 4회로 줄었지만, 0이 되지는 않았다. 연구소는 모델이 시험 상황임을 알아채고 다르게 행동했을 가능성도 함께 짚었다.

출시 철회 이튿날인 9월 29일(현지시간), 오픈AI·구글·메타·앤트로픽·엔비디아·xAI 등 6개사는 백악관에서 도널드 트럼프 대통령과 프런티어 AI 안전에 관한 자율 협약에 서명했다. 각 사는 사이버·생물·화학 위협을 감시하고, 내부 점검과 외부 독립 기관 평가, 이사회 독립위원회의 감독을 받기로 했다.

그러나 협약에는 이행 기한도, 위반 시 벌칙도 없다. 외부 감사 기관도 기업이 직접 고른다. 출시 전 보안 시험 등을 담았던 2023년 7월 바이든 행정부의 자율 약속에 이어, 이번에도 안전 관리를 기업 손에 맡긴 셈이다.

협약 서명 이튿날인 9월 30일(현지시간), 미국 연방거래위원회(FTC)는 오픈AI·앤트로픽 등 AI 기업을 조사 중인 사실을 확인했다. 조사는 올여름 시작됐으며, AI 기업의 불공정·기만 행위와 소비자 피해 가능성이 대상이다. FTC는 자료 제출과 경영진 증언을 강제하는 요구서를 준비 중이며, 결과에 따라 민사 제재금을 부과할 수도 있다.

조사는 잇단 AI 에이전트 사고와 맞물려 있다. 오픈AI는 지난 7월 자사 에이전트가 시험 환경을 벗어나 오픈소스 플랫폼 허깅페이스에 침입했다고 공개해 업계에 충격을 줬다.

이번 철회는 성능 경쟁 속에서도 안전 기준에 못 미친 모델은 내놓지 않겠다는 신호로 읽힌다. 하지만 출시 여부를 판단하는 주체는 여전히 기업 자신이다. 자율협약이 실효성을 얻으려면 외부 평가의 독립성과 결과 공개가 뒷받침돼야 한다. 기업의 '자율'이 규제 당국 앞에서 얼마나 증명될 수 있을지가 다음 과제로 남았다.

정재엽 기자

anihil@tech42.co.kr
기자의 다른 기사보기
저작권자 © Tech42 - Tech Journalism by AI 테크42 무단전재 및 재배포 금지

관련 기사

오리나무 추출물 잇몸케어 제품으로 상용화…닥터오레고닌, 미국 시장도 겨냥

국내 자생 오리나무에서 발굴한 천연 소재가 연구실을 벗어나 잇몸 건강용 의약외품으로 상용화된다.

[K-AX는 지금] AI를 ‘배우는’ 단계에서 업무에 ‘심는’ 단계로…김도경 넥스트젠에이아이 대표가 말하는 AX

기업들의 인공지능 전환(AI Transformation, AX)이 빨라지면서 생성형 AI 교육이나 사내 챗봇 도입, 개념검증(Proof of Concept, PoC)은 더 이상 낯선 일이 아니다. 문제는 그 다음이다. 교육을 받은 직원이 실제 업무에서 AI를 계속 사용하는지, 실험 단계에서 만든 시스템이 기존 업무와 연결되는지, 프로젝트가 끝난 뒤에도 조직이 스스로 AI를 운영하고 확장할 수 있는지는 전혀 다른 문제다. 넥스트젠에이아이는 바로 이 간극을 사업 기회로 삼았다.

철도 설계부터 운영까지 가상에서 검증…다쏘시스템·시스트라 ‘버추얼 트윈’ 협력

파편화된 데이터·모델 하나의 환경으로 연결…철도·교통 인프라 의사결정 지원 시스트라 산업 전문성에 다쏘시스템 3D유니버스·3D익스피리언스 기술 결합 실제 적용 전 설계·시뮬레이션·테스트…인프라 전체...

[K-AX는 지금] “GPU를 몇 개 가졌느냐가 아니라 얼마나 많은 가치를 뽑아내는지가 중요”…신정규 래블업 대표가 말하는 AI 인프라의 ‘운영체제’

올해 래블업은 제품과 글로벌 생태계, 사업 실적 측면에서도 성과를 이어가고 있다. 2025년 미국 산호세에 법인을 설립해 북미 엔터프라이즈 시장을 공략하고 있으며 일본에서도 추론 솔루션을 판매하고 있다. ‘Backend.AI’는 전 세계 120여 개 사이트에서 운영되고 있으며, 래블업은 엔비디아 GTC 등 글로벌 개발자·기술 행사를 통해 제품과 기술을 공개해 왔다.