[Startup 분석] Modal: 서버리스 GPU와 에이전트 실행 인프라

지금 AI 시장에서 진짜 병목은 모델이 아니라 실행 환경이다. 모델은 넘쳐나고, 오픈웨이트도 빠르게 좋아지고 있지만, 실제 서비스에서 문제는 여전히 GPU 확보, 지연시간, 스파이크 트래픽, 보안, 그리고 에이전트가 실행할 런타임이다. 이런 맥락에서 Modal은 2026년 5월 21일 Series C 3억5500만 달러를 유치하며 46억5000만 달러 밸류에이션을 인정받았다. 더 중요한 건 숫자의 속도다. 회사 발표와 Reuters 보도를 종합하면 Modal의 연환산 매출은 약 3억 달러, 지난해 9월 약 6000만 달러 수준에서 빠르게 뛰었다. 지금 이 회사를 봐야 하는 이유는 간단하다. Modal은 “GPU를 빌려주는 회사”가 아니라 AI 애플리케이션의 실행 레이어를 먹으려는 회사이기 때문이다.

왜 지금 Modal이 주목받는가?

핵심은 세 가지다. 첫째, 성장 속도다. Modal은 2026년 5월 공식 블로그에서 2025년 9월 이후 5배 성장했고 연환산 매출 3억 달러를 넘겼다고 밝혔다. 둘째, 제품 포지셔닝이다. 이 회사는 단순 서버리스 GPU가 아니라 inference, training, batch, sandbox를 한 플랫폼 위에 올린다. 셋째, AI 코딩과 에이전트 붐의 직접 수혜자라는 점이다. Modal은 샌드박스가 이미 전체 매출의 3분의 1 이상이라고 공개했고, 10억 개 이상의 샌드박스가 실행됐다고 밝혔다.

  • 투자: 2026년 5월 21일 Series C 3억5500만 달러, 포스트머니 46억5000만 달러
  • 성장: 회사 발표 기준 연환산 매출 3억 달러 돌파, 2025년 9월 이후 5배 성장
  • 전환: 서버리스 GPU에서 에이전트 실행 인프라로 중심축 이동
  • 제품: inference, training, batch, notebooks, sandboxes를 하나의 개발자 경험으로 묶음

기업 개요: Modal은 어떤 회사인가?

Modal은 AI 인프라 플랫폼이다. 개발자는 Python 코드에 몇 줄만 붙여서 GPU 추론, 배치 작업, 모델 학습, 잡 큐, 웹 엔드포인트, 그리고 AI가 생성한 코드를 안전하게 실행하는 샌드박스까지 올릴 수 있다. 회사 문서 기준으로 Modal의 핵심 가치는 간단하다. 서버리스 실행, 초 단위 과금, 인프라 추상화다.

여기서 중요한 포인트는 이 회사가 단지 모델 endpoint를 판매하지 않는다는 점이다. General Catalyst는 Modal을 “어떤 GPU 워크로드든 실행하는 서버리스 실행 레이어”로 설명했고, 추론만이 아니라 학습, 배치, 샌드박스까지 포괄한다고 평가했다. 즉 Modal의 목표는 “좋은 GPU 호스팅”이 아니라 AI 팀이 직접 클라우드 엔지니어링을 하지 않아도 되는 실행 레이어다.

46억5000만 달러 밸류에이션, 왜 이렇게 빠르게 뛰었나?

겉으로 보면 비싸다. Reuters 보도에 따르면 Modal의 직전 평가액은 2025년 가을 약 11억 달러 수준이었고, 이번 Series C는 46억5000만 달러까지 올라왔다. 불과 몇 달 만에 4배 이상 뛴 셈이다. 그런데 이번 숫자는 단순한 분위기만으로 설명되지는 않는다.

첫째, 매출이 붙었다. Reuters 기준 Modal의 연환산 매출은 약 3억 달러이며, 2025년 9월 약 6000만 달러에서 올라왔다. 둘째, 수요 방향이 명확하다. CEO는 Reuters에 지난 6개월간 “코딩이 모든 것을 끌고 갔다”는 취지로 설명했다. 즉 AI 코딩, 에이전트, 샌드박스 실행 수요가 매출 가속의 핵심이라는 뜻이다. 셋째, 자본시장 신호도 강하다. 같은 Reuters 보도에 따르면 이번 라운드는 두 개의 트랜치로 나뉘어 진행됐고, 첫 번째는 25억 달러 밸류에이션, 두 번째는 46억5000만 달러 밸류에이션에서 성사됐다. 투자 수요가 실시간으로 가격을 밀어 올린 구조다.

다만 이 밸류에이션이 완전히 안전하다는 뜻은 아니다. 비상장사 특성상 실제 총마진, 순매출 유지율, 대형 고객 집중도는 외부에서 검증하기 어렵다. 따라서 이 글의 밸류에이션 평가는 공개 숫자와 시장 구조를 바탕으로 한 해석이다.

핵심 제품은 무엇이고, 왜 샌드박스가 중요해졌나?

Modal 문서를 보면 회사의 기능은 넓다. 저지연 추론, 대규모 배치 병렬 처리, 최신 GPU 학습/파인튜닝, 노트북, 웹 엔드포인트까지 제공한다. 그런데 최근 시장이 Modal을 더 높게 보는 이유는 Sandboxes에 있다.

AI 코딩과 에이전트가 실제 제품 안으로 들어가려면, 모델이 생성한 코드를 실행할 안전한 런타임이 필요하다. 그냥 LLM 응답만 잘 나오는 것으로는 부족하다. 격리, 보안, 권한 통제, 병렬 실행, 장애 복구가 필요하다. Modal은 이 점을 일찍 읽고 샌드박스를 1급 primitive로 밀었다. 2026년 5월 회사 발표 기준 샌드박스는 이미 전체 매출의 3분의 1 이상을 차지한다.

  • Inference: 서브초 cold start를 내세운 저지연 추론
  • Training: 최신 GPU 기반 파인튜닝과 멀티노드 학습
  • Batch: 대규모 병렬 처리와 잡 큐
  • Sandboxes: AI 생성 코드와 에이전트 작업을 격리된 환경에서 실행
  • Notebooks / Web Functions: 개발부터 배포까지 같은 추상화 유지

내가 보기에 이 회사의 진짜 강점은 기능 하나하나보다 같은 인터페이스로 여러 워크로드를 묶는 개발자 경험이다. 추론, 배치, 학습, 샌드박스를 따로 사는 순간 운영 복잡도가 다시 커진다. Modal은 그 복잡도를 제품으로 흡수하려 한다.

돈은 어디서 버는가?

Modal의 수익 구조는 전형적인 사용량 기반 인프라 모델에 가깝다. 기본적으로는 GPU, CPU, 실행 시간, 저장소, 네트워크 같은 자원 사용량이 매출을 만든다. 하지만 단순 compute resale만으로 보면 해자가 약하다. 그래서 회사는 더 높은 부가가치가 붙는 레이어로 올라가고 있다.

  • GPU 추론 매출: 실시간 inference와 autoscaling
  • 학습/배치 매출: 대규모 병렬 처리, RL, 파인튜닝
  • 샌드박스 매출: 에이전트와 AI 코딩 실행 환경
  • 엔터프라이즈 계약: 보안, 접근통제, 신뢰성, 지원이 포함된 고가 계약

특히 샌드박스는 중요하다. compute는 가격 경쟁이 심하지만, 안전한 에이전트 실행 환경은 아직 범용 표준이 없다. Modal이 이 레이어를 장악하면 단순 GPU 임대업보다 훨씬 높은 멀티플을 받을 수 있다.

진짜 해자는 기술인가, 아니면 운영 최적화인가?

둘 다지만, 더 중요한 쪽은 운영 최적화다. 2026년 5월 12일 Modal 엔지니어링 블로그에 따르면 회사는 GPU 서버리스 부팅 시간을 줄이기 위해 네 가지를 강조했다. 유휴 GPU 버퍼, 커스텀 파일시스템, CPU checkpoint/restore, 그리고 CUDA checkpoint/restore다. 이 조합으로 추론 서버 스핀업을 수십 분에서 수십 초대로 줄였다고 설명한다.

이건 생각보다 큰 차이다. AI inference는 학습보다 훨씬 트래픽 변동성이 크다. 수요가 튀는 순간 빠르게 GPU를 붙이지 못하면 지연시간이 망가지고, 반대로 너무 많이 잡아두면 비용이 터진다. Modal이 서버리스 GPU를 강조하는 이유는 “편하다”가 아니라 유휴 GPU 비용을 줄이면서도 서비스 품질을 지키는 구조를 만들 수 있어서다.

시장과 경쟁 구도: Modal의 가장 큰 경쟁자는 누구인가?

표면적으로는 경쟁자가 많다. Runpod, Replicate, Baseten, Together 계열 서비스, 그리고 궁극적으로는 AWS/GCP/Azure 같은 하이퍼스케일러가 모두 부딪힌다. 하지만 이 회사를 정확히 보려면 경쟁 구도를 세 층으로 나눠야 한다.

  • 저가 GPU 공급 경쟁: Runpod 같은 서버리스/온디맨드 GPU 플레이어
  • 모델 호스팅 경쟁: Replicate처럼 모델 API와 배포 경험을 파는 플레이어
  • 풀스택 인프라 경쟁: 하이퍼스케일러와 자체 구축을 포함한 넓은 범위의 대안

가격만 보면 시장은 냉정하다. Replicate 가격 페이지 기준 A100 80GB는 시간당 5.04달러, H100은 5.49달러다. Runpod 문서 기준 서버리스 A100 80GB는 active 기준 초당 0.00060달러, 즉 시간당 약 2.16달러 수준이다. 물론 이 숫자는 서비스 구성과 제공 범위가 달라 직접 일대일 비교는 어렵다. 그럼에도 시사점은 분명하다. GPU 원가 경쟁만으로는 오래 버티기 어렵다는 것이다.

그래서 Modal은 가격표보다 제품 통합과 운영 효율에 베팅한다. General Catalyst가 Modal을 “AI 시대의 AWS” 포지션으로 설명한 이유도 여기에 있다. 싸게 빌려주는 곳은 많아질 수 있지만, 개발팀이 여러 워크로드를 같은 인터페이스로 운영하게 만드는 곳은 많지 않다.

이 밸류에이션은 말이 되는가?

현재 공개 숫자만 놓고 보면 아주 싸다고 말하기는 어렵다. 대략적인 계산으로 연환산 매출 3억 달러와 46억5000만 달러 밸류에이션을 비교하면 약 15배 안팎의 매출 멀티플이다. 인프라 회사치고 낮은 숫자는 아니지만, 순수 GPU 리셀러가 아니라 에이전트 시대의 실행 레이어로 보면 완전히 비상식적인 가격도 아니다.

특히 세 가지가 맞으면 오히려 합리적일 수 있다. 첫째, 샌드박스 비중이 계속 커질 것. 둘째, AI 코딩 붐이 일시적 유행이 아니라 지속 수요로 이어질 것. 셋째, 추론과 학습, 배치, 샌드박스를 한 번에 쓰는 고객이 늘면서 이탈 비용이 높아질 것. 반대로 이 중 하나라도 흔들리면 멀티플은 빠르게 압축될 수 있다.

가장 큰 리스크는 무엇인가?

내가 보는 핵심 리스크는 네 가지다.

  • 클라우드 압박 리스크: AWS, Google, Microsoft가 더 나은 개발자 경험과 가격으로 내려오면 방어가 어렵다
  • 원가 압박 리스크: GPU 공급이 빡빡할수록 원가 통제가 어렵고 마진이 흔들릴 수 있다
  • 제품 범위 리스크: 너무 많은 워크로드를 지원하다가 제품 메시지가 흐려질 수 있다
  • 에이전트 과열 리스크: 샌드박스 수요가 기대보다 빨리 꺼지면 성장 서사가 약해질 수 있다

특히 첫 번째가 가장 크다. 인프라 시장은 결국 거대 클라우드와 싸워야 한다. Modal이 이기려면 “더 좋은 GPU 가격”이 아니라 “자체 구축보다 훨씬 빠르고, 하이퍼스케일러보다 훨씬 덜 귀찮은 경험”을 계속 유지해야 한다.

결국 Modal은 GPU 클라우드인가, AI 시대의 운영체제인가?

내 판단은 후자에 더 가깝다. 물론 매출의 상당 부분은 아직 compute usage에서 나온다. 하지만 공개 자료를 보면 회사의 방향은 분명히 상위 레이어로 이동 중이다. inference, training, batch, sandbox를 한 플랫폼으로 묶고, AI 코딩과 에이전트의 실행 레이어를 잡으려 한다. 이게 성공하면 Modal은 GPU 공급자가 아니라 AI 애플리케이션 팀의 기본 운영체제가 된다.

개인적 판단: Modal의 진짜 경쟁자는 GPU 회사가 아니라 복잡성이다

많은 사람이 이 회사를 보면 “또 하나의 GPU 클라우드”라고 생각할 수 있다. 하지만 그 해석은 반만 맞다. Modal이 푸는 핵심 문제는 GPU 대여가 아니라 AI 팀이 복잡한 실행 환경을 직접 짜지 않고도 제품을 배포할 수 있게 만드는 것이다. 인프라 팀이 부족한 스타트업일수록, 그리고 에이전트/코딩/멀티모달 워크로드가 섞일수록 이 가치는 커진다.

그래서 나는 Modal을 단순 인프라 회사보다 조금 더 높게 본다. 다만 전제가 있다. 이 회사가 계속 프리미엄을 받으려면, 샌드박스와 에이전트 런타임을 중심으로 대체하기 귀찮은 플랫폼성을 만들어야 한다. 그냥 GPU를 잘 붙여주는 수준에 머물면 결국 가격 경쟁에 끌려 들어간다. 반대로 AI 개발팀의 기본 실행 표준이 되면, 46억5000만 달러는 비싸 보이지 않을 수도 있다.

참고 자료

Donghun Ryou



Search the website


today visits :

83

total visits :

107419


Comments

답글 남기기