딥마인드 “AI가 인간 넘어설 준비 중…AGI 안전 로드맵 공개”

Google DeepMind has published a detailed strategy paper outlining how it plans to build safe and secure artificial general intelligence (AGI)—AI systems that match or exceed human-level performance in most cognitive tasks. The company sees current machine learning techniques, especially neural networks, as the most viable path to AGI. The paper forecasts powerful AI systems could emerge by 2030, though that timeline is uncertain. DeepMind identifies four major risks: misuse, misalignment, accidents, and structural risks, with immediate focus on the first two.

To counter misuse, DeepMind is introducing cybersecurity evaluations, access controls, and hardened model protections. For misalignment, where AI behavior deviates from human intent, the company is developing multi-layered defenses, such as MONA—a framework for safe short-term optimization. DeepMind is also exploring AI self-evaluation methods, including model debates. The company’s safety efforts are reviewed by internal councils and external partners, and it has released a free AGI safety course for public use.

The paper also addresses infrastructure scaling limits, concluding that energy, hardware, and data bottlenecks are surmountable with investment. DeepMind estimates that training frontier models may cost hundreds of billions, but the economic incentives for automation make such investments feasible.

구글 딥마인드가 AGI(범용인공지능)의 안전한 개발을 위한 종합 전략백서를 공개했다. 이들은 AGI를 ‘대다수 인지 작업에서 인간을 능가하거나 동등한 시스템’으로 정의하며, 현재의 머신러닝 기술(특히 신경망)이 AGI 개발의 주된 경로가 될 것으로 전망했다. 백서에서는 2030년경 고성능 AI 출현 가능성을 언급하면서도, 그 시점은 불확실하다고 덧붙였다.

딥마인드는 AGI의 위험 요소를 ‘오남용, 목표 오정렬, 사고, 구조적 위험’ 등 네 가지로 제시했으며, 현재는 오남용과 오정렬 방지에 주력하고 있다고 밝혔다. 악의적 사용을 막기 위해 사이버 보안 평가, 모델 출력 제한, 강화된 모델 보호 기능 등을 마련했으며, 오정렬 문제에 대해서는 의도 왜곡 탐지, 의심 행동 차단, 의사 결정 상향 조정 체계를 구축 중이다.

AI 스스로 불확실성을 인식하고 행동을 조절하도록 설계하고 있으며, AI 간 상호 검토(디베이트) 방식도 실험 중이다. 딥마인드는 최근 MONA(Myopic Optimization with Nonmyopic Approval)라는 안전성 중심 최적화 프레임워크를 세계 최초로 정식 도입했다고 설명했다.

이 외에도 에너지, 하드웨어, 데이터, 지연시간(latency) 등의 인프라 한계를 분석했으며, AI 훈련 비용은 수백억 달러에 달할 수 있지만, 경제적 유인은 충분하다고 분석했다. 내부적으로는 AGI 안전위원회와 책임·안전위원회가 안전성을 점검하고 있으며, 외부 파트너와 협력해 국제적 거버넌스를 구축 중이다.

버트

ai@tech42.co.kr
기자의 다른 기사보기
저작권자 © Tech42 - Tech Journalism by AI 테크42 무단전재 및 재배포 금지

관련 기사

메타 커넥트 2026 프리뷰…루나·피닉스·아르테미스 나올까

메타가 한국시간 24일 오전 8시 커넥트 2026 기조연설에서 카메라 없는 스마트안경 '루나'를 공개할 전망이다. 홀로그램 화상통화 기기 '피닉스' 시연과 AR 안경 '아르테미스' 공개도 거론된다.

15조 초대형 공룡 미디어 탄생…파라마운트, 반독점 소송 타결로 워너브라더스 품는다

미국 미디어 거물 파라마운트(Paramount)가 110억 달러(약 15조 원) 규모의 워너브라더스(Warner Bros.) 인수 계약을 막아선 캘리포니아 등 12개 주정부의 반독점 소송을 최종 타결했다.

AI 붐 뒤 숨은 '전력·물 먹는 하마'…EU, 데이터센터 '등급표시'로 고삐 죈다

유럽연합(EU) 행정부인 유럽집행위원회가 설비 용량 500kW(킬로와트) 초과 데이터센터의 에너지 및 용수 사용량 공개를 의무화하는 규정안을 발표했다.

“내 일상 감시당했다”… 구글 '타임라인', 당장 휴대폰에서 이 기능 끄세요

구글(Google)의 대표 서비스인 구글 지도 앱의 '위치 타임라인' 기능이 과도한 사생활 침해 우려를 낳고 있다. 이동 경로와 방문 장소를 자동으로 기록해 과거 동선을 파악하기 쉽지만, 개인 동선 정보가 무제한 수집된다는 점에서 사용자 부담이 크다.