GPU 추론 최적화 AI 웨이퍼, 4천만 달러 시리즈A 유치


프로덕션 환경에서 실제 가동 중인 GPU의 평균 활용률은 20% 안팎에 그친다. 기업들은 필요한 컴퓨팅의 5배에 달하는 비용을 치르고 있는 셈이지만, 이를 개선하려면 숙련된 엔지니어팀이 몇 주씩 매달려 배포 설정을 손으로 조정해야 한다. 모델·추론 엔진·하드웨어 조합이 늘어날수록 이 최적화 작업은 더 복잡해진다.

GPU 추론 최적화 AI 웨이퍼, 4천만 달러 시리즈A 유치

웨이퍼(Wafer)는 이 최적화 과정 자체를 AI 에이전트로 자동화하는 회사다. 워크로드의 트래픽 패턴과 성능 제약을 학습한 자율 에이전트가 모델·엔진·커널·하드웨어 전반에서 최적의 배포 조합을 스스로 탐색한다. 회사는 이를 “AI가 AI를 최적화한다”는 한 문장으로 설명한다. 특히 엔비디아(Nvidia) 중심의 GPU 생태계에서 상대적으로 소외된 AMD 등 비엔비디아 칩에서도 실질적인 성능을 뽑아내는 데 강점을 둔다. 지난 7월 진행한 테스트에서는 AMD의 MI355X가 GLM-5.2 등 일부 모델에서 엔비디아 B200 처리량의 약 80%를, 비용은 절반 이하로 구현했다고 회사 측은 밝혔다. 오픈소스 모델 전반에서는 기본 설정 대비 2~2.8배의 속도 향상을 낸다고 설명한다.

웨이퍼는 시카고대 동문인 에밀리오 안데레(Emilio Andere) CEO와 스티븐 아레야노(Steven Arellano) 공동창업자가 세웠다. 아레야노는 구글 바드(Bard) 인프라 개발에 참여했고, 이전에는 퀀트 헤지펀드 투시그마(Two Sigma)에서 일했다. 두 사람은 지난 4월 피프티이어스(Fifty Years) 주도로 400만 달러 규모의 시드 투자를 유치했으며, 당시 리퀴드2(Liquid2)와 와이콤비네이터(Y Combinator)가 참여했고 제프 딘(Jeff Dean)과 워치엑 자렘바(Wojciech Zaremba)가 엔젤 투자자로 이름을 올렸다.

시드 이후 5개월 만인 지난 9월 1일(현지시간), 웨이퍼는 마라톤매니지먼트파트너스(Marathon Management Partners)와 케미스트리(Chemistry)가 공동으로 리드한 시리즈A에서 4천만 달러를 추가로 조달했다고 발표했다. 윙벤처캐피탈(Wing Venture Capital)과 AMD벤처스(AMD Ventures), 아웃셋캐피탈(Outset Capital)이 새로 참여했고, 기존 투자자인 피프티이어스와 와이콤비네이터도 추가로 투자했다. 이번 라운드로 웨이퍼의 기업가치는 2억 달러를 넘어섰는데, 시드 대비 약 50배 뛴 수치다. 여러 클라우드 업체로부터 인수 제안도 받았지만 거절한 것으로 전해졌다.

이번 라운드에는 화려한 엔젤 투자자 명단도 눈길을 끈다. 지난 8월 27년간 몸담은 구글을 떠나 새 회사 디스커버리 루프(Discovery Loop)를 공동창업한 제프 딘을 비롯해, 기예르모 라우크(Guillermo Rauch) 버셀(Vercel) CEO, 앤디 팡(Andy Fang) 도어대시(DoorDash) 공동창업자, 카일 보그트(Kyle Vogt) 더 봇 컴퍼니(The Bot Company) CEO, 악샤이 코타리(Akshay Kothari) 노션(Notion) COO, 매튜 프린스(Matthew Prince) 클라우드플레어(Cloudflare) CEO, 스콧 스티븐슨(Scott Stephenson) 딥그램(Deepgram) CEO 등이 개인 투자자로 참여했다.

웨이퍼는 이번 투자금을 추론 최적화 루프를 더 폭넓게 자동화하는 데 쓸 계획이라고 밝혔다. 모든 배포에 전문 추론 성능팀이 상시 붙어 있는 것과 같은 효과를 내겠다는 목표다.

AI 추론 최적화 경쟁, 오픈소스 스핀오프들이 주도

AI 추론 최적화 시장에서는 인기 오픈소스 프로젝트가 스타트업으로 독립하는 패턴이 최근 두드러진다. LLM 추론 엔진 vLLM 개발팀이 세운 인퍼랙트(Inferact)는 올해 초 시드 라운드에서 1.5억 달러를 유치하며 기업가치 8억 달러를 인정받았다. UC버클리 연구실에서 나온 또 다른 추론 엔진 SGLang을 상업화한 래딕스아크(RadixArk)도 출범 몇 개월 만에 약 4억 달러의 기업가치를 인정받았다. 모델 배포·서빙 플랫폼 베이스텐(Baseten)은 엔비디아가 직접 투자자로 참여하며 기업가치 50억 달러에 3억 달러를 유치하기도 했다. 웨이퍼는 특정 엔진이나 서빙 플랫폼이 아니라 배포 조합 자체를 자동으로 최적화하는 에이전트라는 점에서 이들과 결을 달리한다. 국내외 AI 추론 기업에 대한 자세한 내용은 여기를 참고하시길.

이 기사는 영문기사로 발행되었습니다: AI Inference Optimizer Wafer Raises $40 Million Series A

기사 공유하기

답글 남기기