모티프, 독파모 ‘Motif 3’ 오픈소스 공개…AAII 47점 ‘韓 1위’


AI 기업 모티프테크놀로지스(Motif Technologies)가 독자 AI 파운데이션 모델 ‘모티프 3(Motif 3)’를 허깅페이스에 오픈소스로 공개했다고 13일 밝혔다.

모티프, 독파모 ‘Motif 3’ 오픈소스 공개…AAII 47점 '韓 1위'

모티프 3는 총 3140억(314B) 파라미터, 활성 132억(13.2B) 파라미터의 MoE(전문가 혼합) 구조 대규모 언어모델로, 정부 ‘독자 AI 파운데이션 모델’ 사업 2차에 새로 합류한 모티프테크놀로지스가 약 5개월 만에 사전학습부터 후처리까지 전 과정을 처음부터(from scratch) 개발한 결과물이다.

모티프 3는 글로벌 AI 모델 평가기관 아티피셜 애널리시스(Artificial Analysis)의 종합 지능 지수(AAII)에서 47점으로 한국 기업 중 1위를 기록했다. 이는 글로벌 LLM 중에서도 9위에 해당하는 성적이다. 최근 관심이 높아지고 있는 오픈웨이트 모델 시장에서는 4위를 차지했다. 앤스로픽, 오픈AI 등 미국 기업들과 문샷, Z.ai 등 중국 기업들이 양분하던 프론티어 LLM 시장에서 한국 모델이 의미 있는 성과를 냈다는 평가다.

모티프 3의 성능은 다양한 세부 벤치마크 결과를 통해서도 확인된다. 금융 업무 시나리오에서 AI 에이전트의 과업 완수율을 평가하는 τ³-Banking에서 모티프 3는 35.3점으로 딥시크 V4 Pro(1.6T), Kimi K2.6(1T), GLM-5.1(744B), MiniMax-3(428B), Qwen-3.5(397B) 등 해외 최상위 오픈웨이트 모델 5종을 모두 뛰어넘었다. 딥시크 V4 Pro(30.1)와는 5점 이상, 나머지 모델들과는 12~22점의 큰 격차다.

터미널 환경에서의 실전 코딩·시스템 작업 능력을 측정하는 Terminal-Bench 2.1에서도 74.9점으로 비교군 대비 1위를 기록했다. 2위 Kimi K2.6(65.9)과 9점 차로, 에이전틱 실행 능력의 격차가 가장 선명하게 드러나는 결과다. 장문 추론 능력을 평가하는 AA-LCR에서는 72.3점으로, 자신보다 2~5배 큰 초대형 모델들과 대등한 수준을 유지했다.

실물 경제에서 실제 수행되는 직무 과업을 기반으로 AI의 업무 수행 가치를 평가하는 GDPval v2에서는 38.7점을 기록, 5배 규모인 딥시크 V4 Pro(40.2)와 대등한 상위권에 올랐다. 비교군 중 총 파라미터가 가장 작은 모델로 거둔 성적이다.

신뢰성 지표에서도 강점이 확인됐다. 모르는 내용을 아는 것처럼 지어내지 않는지를 측정하는 AA-Omniscience 논-할루시네이션 점수에서 71.6점으로 비교군 중 상위권(2위)에 올랐다. 딥시크 V4 Pro(5.9)·Qwen-3.5(11.1) 등 다수의 초대형 모델이 이 지표에서 극히 낮은 점수에 그친 것과 대비되는 결과로, 환각(할루시네이션) 억제 능력은 AI의 실제 업무 현장 도입에서 가장 중요한 신뢰성 요소로 꼽힌다. 이 밖에 소프트웨어 엔지니어링(SWE-bench Verified) 76.2점, 전문가급 초고난도 지식 평가인 ‘인류 최후의 시험(Humanity’s Last Exam)’ 37.0점 등 핵심 벤치마크 전반에서 고른 성능을 입증했다.

특히 이러한 우수한 성적을 총 3140억개 파라미터, 활성 132억 파라미터라는 규모에서 달성했다는 점도 주목된다. 총 1조 파라미터를 넘나드는 초대형 모델과의 경쟁 속에서, 실제 서비스 비용을 좌우하는 활성 연산량을 최소 수준으로 유지하면서 프론티어급 성능에 도달한 것으로, ‘연산량 대비 지능(intelligence per FLOP)’ 관점에서 세계 최고 수준의 효율이다.

모티프테크놀로지스는 모티프 3 정식 모델을 MIT 라이선스로 모델 가중치는 물론 학습 코드와 라이브러리까지 공개했다. MIT 라이선스는 상업적 활용을 포함한 가장 제약이 적은 오픈소스 공개 방식으로, 국내 기업·연구기관·개발자 누구나 자유롭게 활용할 수 있다. 모티프테크놀로지스는 창사 이래 Motif-2.6B, 12.7B, Video-2B 등 개발한 모든 모델을 오픈소스로 공개해 온 이력을 갖고 있다.

또한 테크니컬 리포트를 통해 모티프테크놀로지스가 지금까지 쌓아온 독자적인 아키텍처들을 상세히 공개했다. 모티프 3의 성과는 독자 기술에 기반한다. 모티프테크놀로지스는 자체 개발한 어텐션 구조 GDLA(Grouped Differential Latent Attention)를 비롯해 아키텍처, 옵티마이저, 후처리 등 모델 개발 전 계층에 걸쳐 자체 설계 기술을 적용했으며, 공개 기술을 활용할 때도 기존 기술의 한계를 먼저 규명하고 개선하는 방식(mHC 결함 규명 후 α-decay 도입, Muon 옵티마이저 불안정성 해결을 위한 MuonClip 개발 등)을 일관되게 적용했다.

모티프테크놀로지스는 언어모델 외에도 비전(7B), 오디오(0.7B), 비디오 VAE(1.2B) 등 3개 모달리티 인코더를 병행 개발해 총 4개 모듈을 완성, 공개했다. 자체 비전 인코더는 메타(Meta)의 V-JEPA 2.1, DINOv3 등 해외 최신 비전 모델을 상회하는 성능을 보임으로써 이후 멀티모달 모델로의 확장에 대한 기대를 높였다.

모티프테크놀로지스는 정부 독자 AI 파운데이션 모델 사업에 2차부터 새롭게 합류한 팀이다. 1차부터 사업을 수행해 온 기존 참여 기업들과 달리, 앞선 차수에서 축적할 수 있었던 모델 자산이나 준비 기간 없이 출발했다. 그럼에도 5개월이라는 제한된 기간 안에 3140억개 규모 모델의 풀 스크래치(Full Scratch) 개발과 3개 모달리티 모듈 병행 개발을 동시에 완수하며 글로벌 최상위권 성능에 도달했다. 이러한 개발은 정부가 제공한 엔비디아 B200 GPU 768장 규모의 인프라에서 이뤄졌으며, 학습 기간 내내 97.9~100%의 GPU 가동률을 유지하는 등 시스템·인프라 최적화 역량도 함께 입증했다.

임정환 모티프테크놀로지스 대표는 “모티프 3는 짧은 기간과 제한된 자원 속에서 독자 아키텍처만으로 글로벌과 경쟁할 수 있는 수준임을 증명한 시작점”이라며 “출발선이 달랐던 만큼, 같은 조건이 주어졌을 때 우리가 어디까지 갈 수 있는지는 이제부터가 증명의 시간”이라고 말했다.

모티프테크놀로지스는 이번 모티프 3를 통해 미국, 중국 기업들과 대등하게 경쟁할 수 있는 잠재력을 검증한 만큼, 다음 단계로는 진정한 글로벌 프론티어 수준 달성에 도전한다. 모티프 3의 고도화와 더불어, 차세대 모델인 모티프 4에서는 글로벌 5위권으로 성능을 끌어올려 글로벌 AI 모델 시장의 최선단에서 경쟁하겠다는 목표다. 이와 함께 이번에 완성한 비전·오디오·비디오 모듈을 언어모델과 결합한 완전한 멀티모달 통합 모델로 확장할 계획이다.

모티프테크놀로지스는 앞서 지난 5월 나이스투자파트너스와 노틸러스인베스트먼트, 디토인베스트먼트, 포레스트벤처스로부터 240억 원 규모의 시리즈B 투자를 유치한 바 있다. 정부의 독자 AI 파운데이션 모델 사업을 통해 개발 중인 대규모 언어모델 ‘모티프 3’는 지난 7월 중간 평가에서 중국 딥시크 최신 모델과 동급 성능을 기록하며 글로벌 수준의 기술력을 입증했다. 8월에는 자체 개발 LLM ‘Motif-2-12.7B’를 마이크로소프트 마켓플레이스에 등록하기도 했다.

국내 AI 기업들이 대규모 언어모델 개발에서 성과를 내고 있다. 사이오닉에이아이의 검색 임베딩 모델 ‘comsat-embed’가 한국어·일본어 글로벌 벤치마크에서 1위를 기록하는 등 한국어 특화 AI 모델의 경쟁력이 높아지고 있다.

기사 공유하기

답글 남기기