DGX Spark 64GB, 로컬 AI를 실행하는 소형 컴퓨터

엔비디아가 10월 2일 DGX Spark의 64GB 모델을 발표했다. 책상 위에 두고 AI 모델을 직접 실행하는 소형 컴퓨터에 새로운 메모리 선택지가 추가된 것이다. 공개된 모델을 내려받아 코딩 도구나 문서 처리용 AI를 구성하고, 필요하면 두 기기를 연결해 더 큰 작업을 처리하는 제품이다. 다만 발표와 판매 시작은 다르다. 새 모델의 출시 예정일은 10월 23일이다. 엔비디아 공식 발표

AI 모델을 내 컴퓨터에서 돌린다는 뜻

DGX Spark는 GB10 Grace Blackwell 칩과 AI 실행용 소프트웨어를 묶은 개발 플랫폼이다. 사용자가 질문을 입력하면 외부 서비스의 서버가 답을 생성하는 대신, 기기에 설치한 모델이 계산을 수행한다. 엔비디아는 에이전트 개발과 모델 시험, 데이터 분석 등을 주요 용도로 소개한다. 이미 만들어진 모델을 업무에 맞게 조정하는 미세조정도 제품군의 활용 범위에 들어간다. DGX Spark 제품 설명

예를 들어 사내 문서를 읽고 답하는 프로그램을 만들 때, 문서를 외부 모델 API에 보내지 않고 로컬 모델에 전달하는 구성을 생각할 수 있다. 개발 중인 코드를 분석하는 도구도 같은 방식으로 설계할 수 있다. 이는 제품의 실행 구조를 바탕으로 든 활용 예시다. 컴퓨터를 구입하는 것만으로 문서 검색이나 코딩 에이전트가 완성되는 것은 아니며, 사용할 모델과 프로그램을 따로 선택해야 한다.

64GB는 모델이 사용할 공간이다

제품 페이지는 GB10 칩과 DGX OS를 사용하는 64GB·128GB 메모리 선택지를 안내한다. 엔비디아는 64GB 구성에서 최대 1,000억 개 파라미터의 모델을 실행할 수 있다고 설명한다. 파라미터는 모델이 학습한 수치들이며, 이를 메모리에 올려 계산해야 답을 생성할 수 있다. 이 수치는 회사가 제시한 지원 범위이지 모든 1,000억 파라미터 모델의 속도나 품질을 보장하는 결과는 아니다. 64GB 구성의 지원 범위

DGX Spark는 CPU와 GPU가 같은 시스템 메모리를 공유하는 통합 메모리 구조를 쓴다. 일반적인 외장 그래픽카드처럼 GPU 전용 메모리가 별도로 있는 방식과는 다르다. 공식 문서도 이 차이 때문에 일부 도구가 표시하는 사용 가능 메모리와 실제 확보 가능한 메모리가 다를 수 있다고 설명한다. 통합 메모리에 관한 기술 문서

모델 크기만 보고 기기를 고르기는 어렵다. 대화가 길어질수록 이전 내용을 처리하기 위한 공간이 필요하고, 여러 작업을 동시에 실행해도 여유 메모리가 줄어든다. 사용할 모델의 저장 형식과 대화 길이, 동시 사용 조건을 함께 확인해야 한다. 제품 페이지의 최대 파라미터 수는 이런 조건을 대신하는 사용 성능표로 읽으면 안 된다.

노트북에서 접속해 사용할 수 있다

기기 앞에 모니터와 키보드를 항상 연결할 필요는 없다. NVIDIA Sync를 노트북에 설치하면 DGX Spark에 접속해 지원되는 개발 도구나 프로그램을 실행할 수 있다. Sync는 Windows, macOS, Ubuntu를 지원하며, 원격 접속과 프로그램 화면에 접근하기 위한 연결을 뒤에서 관리한다. 계산은 DGX Spark가 맡고 사용자는 평소 쓰던 노트북에서 작업하는 구성이다. NVIDIA Sync 사용 안내

실제 구성 방법을 보여주는 자료도 있다. 엔비디아의 Open WebUI 예제는 모델 실행 도구인 Ollama와 웹 대화 화면을 함께 설치해 브라우저에서 로컬 모델과 대화하도록 만든다. 다만 현재 이 예제의 지원 표에는 128GB 기기가 명시돼 있다. 기존 예제가 있다는 사실을 새 64GB 모델의 모든 설정이 검증됐다는 뜻으로 확대해서는 안 된다. Open WebUI와 Ollama 구성 예제

두 대를 연결하면 무엇이 달라지나?

엔비디아는 두 대의 64GB 기기를 연결해 총 128GB의 메모리를 활용하는 구성을 소개했다. Qwen 3.8 27B를 사용한 자사 시험에서는 한 대 대비 최대 1.7배 성능을 제시했다. 특정 모델과 시험 조건에서 나온 회사 측 결과이므로, 다른 모델이나 모든 작업에서도 같은 향상을 기대할 수 있는 수치는 아니다. 두 기기를 연결한 시험 결과

연결에는 기기에 내장된 ConnectX-7 네트워크와 QSFP 케이블을 사용한다. Sync의 Cluster Assistant가 기기 상태와 연결을 검사하고 네트워크를 설정한다. 여러 컴퓨터를 함께 쓰는 클러스터를 만들 때 복잡했던 통신 설정을 도와주는 기능이다. Cluster Assistant 문서

여기에는 중요한 범위 제한이 있다. 공식 문서는 Cluster Assistant가 네트워크만 설정하며, 모델 추론이나 미세조정 작업까지 구성하지는 않는다고 명시한다. 케이블을 꽂았다고 모든 프로그램이 두 기기의 메모리를 자동으로 쓰는 것은 아니다. 사용자는 분산 실행을 지원하는 도구와 작업 환경을 별도로 준비해야 한다. 발표의 간편한 연결 설명과 실제 모델 실행 준비를 구분해서 볼 부분이다. 자동 설정의 범위와 한계

지금 이용하려면 확인할 것

10월 6일 기준 64GB 모델은 출시 예정 제품이다. 엔비디아가 발표한 시작 가격은 4,999달러이며, Acer, ASUS, Dell, Gigabyte, HP, MSI 등 제조사 파트너를 통해 제공될 예정이다. 한국 판매 일정과 원화 가격은 이번에 확인한 자료만으로 확정할 수 없다. 출시 일정과 가격 안내

운영체제인 DGX OS는 Ubuntu 기반의 Linux다. AI 작업에 필요한 드라이버와 설정을 제공하지만, 보안 업데이트와 시스템 관리는 계속 필요하다. 로컬 실행으로 데이터 전송을 줄일 수 있어도, 외부 API를 연결한 프로그램이나 웹에 접속하는 에이전트의 통신까지 사라지지는 않는다. 실제 데이터가 어디로 나가는지는 사용하는 프로그램과 연결 설정에 따라 확인해야 한다. DGX OS 설명

What’s next?

엔비디아는 10월 말 Sync Model Launcher를 제공할 예정이라고 밝혔다. 모델을 내려받아 단일 기기나 클러스터에서 실행하고 코딩 도구에 연결하는 과정을 돕는 기능이다. 현재의 네트워크 설정 도구와 앞으로 추가될 모델 실행 도구는 별개다. 예고된 후속 기능

Donghun Ryou



Search the website


today visits :

348

total visits :

121159


Comments

답글 남기기