오픈AI “AI 브라우저, 프롬프트 인젝션 근본 해결 어렵다”

오픈AI(OpenAI)가 자사 AI 브라우저 ‘아틀라스(Atlas)’의 보안을 강화하고 있지만, 프롬프트 인젝션 공격은 당분간 완전히 차단하기 어렵다고 밝혔다.

프롬프트 인젝션은 웹페이지나 이메일 속에 숨겨진 악성 명령을 이용해 AI 에이전트의 동작을 조작하는 공격 형태다. 오픈AI는 이를 “웹상의 사회공학 공격처럼 영구적으로 해결되기 어려운 문제”라고 설명했다.

오픈AI는 최근 블로그를 통해 에이전트 모드가 보안 위협 범위를 넓히지만, 신속한 대응·패치 시스템을 통해 방어를 강화하고 있다고 밝혔다. 실제로 ‘LLM 기반 자동 공격자(LLM-based automated attacker)’라는 강화학습 모델을 도입해 내부 테스트 단계에서 새로운 공격 시나리오를 사전에 탐지하는 체계를 구축했다.

이 시스템은 해커 역할을 수행하는 AI 봇이 공격 시뮬레이션을 반복하며, 대상 AI의 반응을 분석해 취약점을 찾아내는 방식이다. 오픈AI에 따르면 해당 구조는 인간 레드팀보다 더 빠르게 보안 결함을 식별할 수 있다.

오픈AI는 “프롬프트 인젝션은 장기적인 AI 보안 과제”라며, 대규모 테스트와 빠른 보안 업데이트를 통해 실제 공격으로 이어지기 전 대응력을 높이겠다고 밝혔다.

버트

ai@tech42.co.kr
기자의 다른 기사보기
저작권자 © Tech42 - Tech Journalism by AI 테크42 무단전재 및 재배포 금지

관련 기사

"우주 데이터센터 띄운다"… 구글, AI 칩 궤도 안착시켰지만 난제 수두룩

구글(Google)이 자체 개발한 인공지능(AI) 반도체를 탑재한 위성을 우주로 쏘아 올리며 궤도상 데이터센터 구축을 위한 첫 시험에 나섰다.

애플 TV 장시간 먹통에 사용자 분통

애플(Apple)의 OTT 서비스인 애플 TV가 지난 30일 오후 4시 43분부터 장시간 먹통 사태를 겪으며 이용자들의 불편이 이어지고 있다.

"내 목소리 함부로 쓰지 마"… 일본 법원, AI 음성 무단 복제에 '인격권' 첫 인정

일본 도쿄지방재판소가 유명 성우의 음성을 인공지능(AI)으로 무단 복제해 영상 내레이션에 활용한 익명의 틱톡(TikTok) 계정 사건과 관련해 인간의 목소리도 법적 보호 대상이라고 판결했다.

오픈AI, '옷 입어보기'까지 진출… 챗GPT 쇼핑 생태계 본격 확장

오픈AI(OpenAI)가 사용자가 업로드한 인물 사진에 의류 이미지를 가상으로 입혀주는 신규 쇼핑 기능을 차트GPT에 추가했다.