구글 AI 검색 주역들의 ‘딥코지토’, 4,300만 달러 시리즈A 유치


같은 모델이라도 사전학습(pre-training) 이후에 어떻게 다듬느냐가 실력을 가른다는 쪽에 베팅하는 스타트업들이 늘고 있다. 알파고의 강화학습 기법이 제미나이(Gemini)에 이식되며 소형 모델의 성능을 끌어올리는 흐름이 이어지는 가운데, 사후학습(post-training)과 자기개선 강화학습을 전문으로 하는 연구소 딥코지토(Deep Cogito)가 4,300만 달러 시리즈A를 유치했다고 발표했다.

TQ벤처스(TQ Ventures)가 주도했고 벤치마크(Benchmark)·넥서스벤처파트너스(Nexus Venture Partners)·아트레이드스매니지먼트(Atreides Management)·사우스파크커먼스(South Park Commons)가 참여했고, 고객사이자 전략적 투자자로 즈스케일러(Zscaler)도 이름을 올렸다. 이번 라운드로 누적 투자금은 5,600만 달러를 넘겼다.

구글 AI 검색 주역들의 '딥코지토', 4,300만 달러 시리즈A 유치

딥코지토는 2024년 구글의 AI 검색 제품(AI 모드·AI 개요)을 만들었던 드리샨 아로라(Drishan Arora)와 드루브 말라나(Dhruv Malrana)가 공동창업했다. 아로라는 구글에서 AI 검색용 제미나이의 사후학습을 이끌었고, 말라나는 초기 단계부터 이 제품의 프로덕트를 총괄했다. 두 사람은 “AI 성능의 격차는 앞으로 대부분 사후학습에서 갈릴 것”이라는 가설 하나로 회사를 시작했다.

회사의 연구는 대규모 강화학습과 재귀적 자기개선(recursive self-improvement)에 초점을 맞춘다. 핵심 연구 방향인 ‘반복 증류·증폭(Iterated Distillation and Amplification, IDA)’은 모델이 추가 연산을 써서 스스로 낼 수 있는 것보다 더 나은 답을 만들게 한 뒤, 그 개선분을 다시 모델 가중치에 증류해 넣는 과정을 반복한다. 장기적으로는 모델이 스스로의 능력을 점진적으로 끌어올려 결국 인간이 만든 학습 데이터의 한계를 넘어서게 하는 것이 목표다. 창업자 아로라 CEO는 “사전학습이 모델에 방대한 지식과 역량을 준다면, 사후학습은 그 모델이 실제로 무엇이 될 수 있는지를 결정한다”고 말했다.

딥코지토는 이 사후학습 기법을 오픈웨이트 모델 ‘코지토(Cogito)’ 시리즈로 먼저 검증해 왔다. 30억(3B)에서 6,000억(600B) 파라미터가 넘는 모델까지 다양한 크기에서 성능을 끌어올리는 걸 입증했는데, 최신 671B 플래그십 모델은 딥시크(DeepSeek)의 최신 R1 0528 모델과 맞먹거나 앞서면서도 추론 과정은 60% 더 짧다는 게 회사 설명이다. 같은 사후학습 엔진을 이제 기업 고객에게도 제공한다. 기업이 보유한 자체 데이터·의사결정·성과 데이터로 특화 모델을 만들어주는 플랫폼이다.

즈스케일러는 원래 딥코지토의 고객이었다가 이번에 전략적 투자자로도 참여했다. 즈스케일러의 다왈 샤르마(Dhawal Sharma) AI 보안·전략 담당 부사장은 “프론티어 모델은 쓸모는 있었지만 우리가 필요로 한 수준의 특화에는 부족했다”며 “딥코지토는 가벼운 커스터마이징을 넘어, 우리 제품과 우리가 중요하게 보는 지표를 깊이 이해하고 그 지능을 모델 자체에 학습시켜 넣었다”고 말했다. TQ벤처스의 슈스터 탱어(Schuster Tanger) 공동창업파트너는 “이 정도 규모로 모델을 사후학습할 수 있다는 걸 증명한 팀은 최대 AI 랩들을 빼면 거의 없다”고, 벤치마크의 에릭 비쉬리아(Eric Vishria) 제너럴파트너는 “사후학습은 AI에서 가장 중요한 레이어 중 하나가 되고 있고, 딥코지토는 그 레이어의 최전선에서 실제로 작동한다는 걸 보여줬다”고 평가했다. 조달한 자금은 연구·엔지니어링 팀 확충, 프론티어 모델 학습용 인프라 확장, 코지토 후속 모델 개발, 기업용 특화 모델 사업 확대에 쓰인다.

“모델 스스로 지능을 개선한다”는 목표를 내건 곳은 딥코지토만이 아니다. 오픈AI 전 CTO 미라 무라티(Mira Murati)가 세운 씽킹머신즈랩은 엔비디아로부터 전략적 투자를 받으며 기가와트급 AI 칩을 공급받기로 했고, 구글 딥마인드 출신들이 만든 리플렉션AI는 “초지능 개발”을 목표로 내걸고 출범해 1년 7개월 만에 기업가치를 15배 키운 80억 달러에 20억 달러를 유치했다. 오픈AI 창업자 일리야 수츠케버(Ilya Sutskever)의 세이프수퍼인텔리전스(SSI)도 컴퓨팅을 10배 확대하겠다며 50억 달러 투자 유치를 진행 중이라고 보도됐다.

다만 이들 대부분은 처음부터 초거대 자체 모델 개발에 뛰어든 반면, 딥코지토는 상대적으로 적은 자본으로 사후학습이라는 한 계층에 집중해 성과를 냈다는 점에서 결이 다르다. 오픈웨이트 모델 경쟁은 중국 랩들이 주도해 왔지만, 미국 쪽에서도 엔비디아가 풀사이드에 대규모 베팅을 하는 등 대항마를 키우려는 움직임이 이어지고 있다. 프론티어 AI 랩을 둘러싼 투자 관계망 전반에 대한 자세한 내용은 여기를 참고하시길.

이 기사는 영문기사로 발행되었습니다: Deep Cogito Raises $43M Series A to Advance the Post-Training Engine for Frontier Intelligence

기사 공유하기

답글 남기기