모티프, 성능 앞섰지만 사용성·활용성 뒤처져
정부, B200 지원 확대…내년 초 최종 2팀 선정
▲류제명 과학기술정보통신부 2차관이 18일 서울 종로구 정부서울청사에서 독자 AI파운데이션모델 프로젝트 2차 단계평가 결과 브리핑을 하고 있다. 사진=연합뉴스
한국을 대표할 독자 인공지능(AI) 파운데이션 모델을 가리는 경쟁이 LG AI연구원과 SK텔레콤, 업스테이지의 3파전으로 압축됐다. 글로벌 성능 평가에서 가장 높은 점수를 받은 모티프테크놀로지스는 사용성과 활용성 평가에서 밀리며 탈락했다.
과학기술정보통신부는 18일 정부서울청사에서 '독자 AI 파운데이션 모델 프로젝트' 2차 단계평가 결과를 발표하고 LG AI연구원, SK텔레콤, 업스테이지 등 3개 정예팀이 다음 단계에 진출한다고 밝혔다. 지난 2월 추가 공모를 통해 합류한 모티프테크놀로지스는 최하위를 기록해 탈락했다.
이번 평가는 벤치마크 40점, 전문가 35점, 사용자 25점 등 총 100점으로 진행됐다. 3개 평가 영역에서 모두 1위를 차지한 기업은 없었으며 영역별 1위도 각각 달랐다. 개별 기업의 종합 순위와 점수는 공개되지 않았다.
팀 간 격차도 크지 않았다. 벤치마크 평가에서 4개 팀 평균은 22.5점으로 1위와 4위의 격차가 4점에 그쳤다. 전문가 평가는 평균 28.8점에 1·4위 간 2.4점, 사용자 평가는 평균 17.6점에 5점 차였다.
특히 모티프는 모델 자체의 기술 성능에서는 두각을 나타냈지만, 실제 활용 가능성을 포함한 종합평가에서 경쟁사에 뒤처졌다.
류제명 과기정통부 2차관은 “모티프는 기술력 측면에서 뛰어난 성과를 보여줬으나 전체 배점의 75점에 달하는 사용성과 활용성 부문 등에서 타 기업 대비 다소 낮은 평가를 받았다"고 설명했다.
모티프의 '모티프3'는 글로벌 AI 모델 평가 플랫폼 아티피셜 어낼리시스의 지능·성능 평가 지수(AAII)에서 47점을 기록해 전 세계 기업별 AI 모델 가운데 10위에 올랐다. 미국과 중국 이외 국가의 모델 중 가장 높은 수준이다. 수학과 코딩, 에이전트 능력을 하나의 모델에 통합한 에이전트 특화 모델로 개발됐다.
2차 평가에 참여한 나머지 모델들도 분야별 경쟁력을 나타냈다.
업스테이지의 '솔라 오픈 2'는 한 번에 처리할 수 있는 문맥 창을 최대 100만(1M) 토큰까지 확보해 장문 처리 능력을 끌어올렸다. 포털 다음 서비스 환경에서의 실증과 퓨리오사AI의 신경망처리장치(NPU)를 활용한 국산 소프트웨어(SW)·하드웨어(HW) 결합도 긍정적인 평가를 받았다.
SK텔레콤의 'A.X K2'는 2026년 국제수학올림피아드(IMO) 문제 평가에서 금메달 기준 점수를 기록했다. 미국수학경시대회(AIME) 기반 벤치마크에서는 97.1%의 정확도를 기록했다. 대규모 상용 서비스 탑재와 국방·제조·법무·세무 등 산업 특화 에이전트 적용 가능성도 강점으로 평가됐다.
LG AI연구원의 'K-엑사원 2.0'은 국내 최대 수준인 7500억개 파라미터 규모로 구축됐다. AI 모델의 환각 최소화 지표에서 글로벌 9위에 올랐으며 국제기구와의 협업 전략과 에이전틱 AI 차별성, 모델 위험요인 관리 등에서 좋은 평가를 받았다.
4개 팀 모델은 AAII에서 모두 31점 이상을 기록했다. 과기정통부와 정보통신산업진흥원(NIPA)은 이를 토대로 한국 모델의 성능이 유럽과 캐나다 등 주요 국가 모델을 앞섰으며, 국가별 프론티어 AI 모델 성능에서도 미국과 중국에 이어 한국이 3위권에 진입했다고 평가했다.
정부는 다음 단계에 진출한 3개 팀에 대한 컴퓨팅 인프라 지원도 확대한다. 엔비디아의 고성능 그래픽처리장치(GPU) B200 지원 규모를 올해 상반기 768장에서 하반기 1000장 수준으로 늘릴 계획이다.
최동원 과기정통부 인공지능인프라정책관은 “6개월간 1000장을 임차할 경우 팀당 약 400억원이 소요되며 3개 팀 지원 규모는 총 1200억원 수준"이라고 말했다.
정부는 당초부터 단계평가를 거쳐 참여팀을 압축하면서 살아남은 정예팀에 GPU 지원을 확대하는 경쟁형 방식을 설계했다. 2025년 사업 공고 당시에도 팀당 GPU 500장 수준에서 시작해 단계평가를 거쳐 1000장 이상으로 지원 규모를 늘린다는 계획을 제시한 바 있다.
최종 관문에서는 LG AI연구원과 SK텔레콤, 업스테이지 가운데 2개 팀이 선정된다. 최종 선정 시점은 내년 초로 예정돼 있다. 정부는 3차 평가를 예정대로 진행하되 기존 경쟁형 지원체계와 별도로 글로벌 프론티어 AI 기업과 경쟁할 수 있는 모델을 육성하기 위한 새로운 지원방안도 관계부처와 논의하고 있다.
류 차관은 “소수 승자만을 뽑는 방식을 탈피해 프론티어 기업에 버금가는 모델 경쟁이 가능하도록 지원 방식을 전면 재편하는 방안을 논의 중"이라며 “정부 예산이 확정되는 대로 구체적인 방안을 발표할 것"이라고 말했다.

