업스테이지, 챗GPT 넘어 ‘세계 최고 LLM'

국내 대표 AI 스타트업 업스테이지가 개발한 생성 AI 모델이 오픈AI의 챗GPT를 넘어 세계 최고 LLM 타이틀을 고수했다.

업스테이지는 자사가 개발한 생성 AI 모델이 세계 최대 머신러닝 플랫폼 허깅페이스에서 운영하는 '오픈 LLM 리더보드' 평가 점수에서 72.3점을 획득하여, 챗GPT의 기반인 GPT-3.5 성능을 뛰어넘고 1위를 차지했다고 1일 밝혔다.

이 리더보드는 전 세계 500여개의 오픈 모델들이 추론과 상식 능력, 언어 이해 종합능력 및 환각현상(할루시네이션) 방지 등 4가지 지표의 평균 점수로 경쟁하며 순위를 매긴다.

앞서 지난 달 업스테이지가 허깅페이스를 통해 공개한 30B(300억) 매개변수 모델은 평균 67점을 획득, 같은 날 발표된 메타의 '라마(LLaMA) 2' 70B 모델을 추월하고 국내 LLM 최초 1위 달성이라는 쾌거를 올린 바 있다. 이에 업스테이지는 더 많은 데이터로 최신 라마 2 70B(700억) 매개변수 기반으로 파인튜닝한 모델을 내놓으며 글로벌 1위 굳히기에 나섰다. 그 결과, 새롭게 공개된 업스테이지 70B 모델은 리더보드 평가에서 72.3점을 기록, 미국 스테빌리티(Stability) AI의 ‘스테이블 벨루가2’ 모델(71.4점)을 뛰어넘고 세계 1위를 재탈환하는 쾌거를 이뤄냈다.

특히, 업스테이지의 최신 모델은 챗GPT의 기반이 되는 GPT-3.5의 벤치마크 평가(71.9점) 점수를 넘어선 이변적인 성과를 보여줬다. 업스테이지 관계자는 "허깅페이스 리더보드 기준 GPT-3.5의 점수를 능가한 사례는 업스테이지가 최초"이라며 "토종 스타트업이 개발한 소형 LLM이 글로벌 빅테크 기업의 초거대 모델과 견주어도 충분한 경쟁력이 있다는 것을 증명했다"고 말했다.

앞으로 업스테이지는 자사의 AI 모델 상용화를 통해 본격적인 '프라이빗(Private) AI' 시장 개척에 나선다. 프라이빗 AI는 기업 내부데이터만 학습해 정보 유출을 막고 환각 현상을 방지하는데 특화된 솔루션으로, 보안 이슈 등으로 생성 AI 도입을 주저하는 기업들에게 매력적인 대체재로 각광받고 있다.

김광우 기자

kimnoba@tech42.co.kr
기자의 다른 기사보기
저작권자 © Tech42 - Tech Journalism by AI 테크42 무단전재 및 재배포 금지

관련 기사

국민연금, 카톡에서 조회하고 가입한다…카카오 ‘AI 국민비서’ 실행 기능 확대

17일 가입내역 조회 이어 30일부터 임의가입 신청 지원 가입 가능 여부·예상 보험료 계산부터 카카오 인증서 본인인증까지 대화 흐름으로 국민연금공단과 서비스...

[스타트업 안테나] 링크알파 금융 AI 데이터 공급·알비웨어 9억원 투자·오노마AI 뉴욕대 프로그램 선정

30일 스타트업·기술기업 업계에서는 금융과 제조, 콘텐츠, 마케팅, 교육, 산업안전 등 다양한 영역에서 인공지능(AI)을 실제 업무와 서비스에 적용하려는 움직임이 이어졌다. 링크알파는 금융기관의 자체 AI 에이전트에 활용할 수 있는 금융 데이터 마켓플레이스를 선보였고, 알비웨어는 스파크랩과 SOSV로부터 9억원 규모의 시드 투자를 유치했다. 오노마에이아이는 뉴욕대학교 스턴 경영대학원의 글로벌 기술 스타트업 성장 프로그램에 선정됐으며, 아르투는 오픈AI 본사에서 AI와 미술 전시를 결합한 프로젝트를 진행했다.

[현장] 와트 뒤엔 볼턴, 테슬라 뒤엔 웨스팅하우스가 있었다…궤도가 말한 ‘딥테크의 조건’

(왼쪽부터) 니콜라 테슬라가 교류 시스템을 조지 웨스팅하우스에게 설명하는 모습을 AI로 생성한 이미지. 이후 웨스팅하우스는 테슬라의 교류 관련 기술을 사업화했고, 1893년 시카고 세계박람회에서 교류 시스템의 실용성을 대규모로 보여줬다. 특히 나이아가라 폭포 수력발전 사업은 다상 교류 시스템의 장거리 전력공급 가능성을 입증하는 중요한 계기가 됐다. 이 과정에서 테슬라의 기술뿐 아니라 웨스팅하우스의 자본과 사업화 능력, 웨스팅하우스 소속 기술자들의 추가적인 공학적 개선이 함께 작용했다. (이미지=AI로 생성)

카카오, AI 모델 넘어 에이전트까지 안전성 검증…AI안전연구소와 3단계 협력

언어모델 배포 전·후 평가 시작해 멀티모달·AI 에이전트로 범위 확대  카카오 모델·인프라 제공…인공지능안전연구소는 평가 수행·방법론 고도화  안전성 검증 효율 높이는 공동...