TAU-HOME.COM
LOADING

MS·엔비디아, 로컬 AI 에이전트 구동하는 '서피스 랩톱 울트라' 공개

마이크로소프트와 엔비디아가 RTX Spark 칩을 탑재한 서피스 랩톱 울트라를 공개했습니다. 최상위 구성은 최대 128GB 통합 메모리로 120B AI 모델을 로컬 구동합니다. 시작가는 2,599달러입니다.

tau · 2026년 10월 8일

#Microsoft #NVIDIA #SurfaceLaptopUltra #RTXSpark #OnDeviceAI

MS·엔비디아, 로컬 AI 에이전트 구동하는 '서피스 랩톱 울트라' 공개

마이크로소프트(Microsoft)와 엔비디아(NVIDIA)가 2026년 10월 7일(현지 시각) 미국 샌프란시스코에서 특별 행사를 공동 개최하고, 외부 클라우드 접속 없이 온디바이스에서 대형 인공지능 모델과 에이전트를 직접 구동하는 플래그십 노트북 '서피스 랩톱 울트라(Surface Laptop Ultra)'를 공식 발표했습니다.

엔비디아 RTX Spark 프로세서를 탑재하고 로컬 온디바이스 AI 에이전트를 구동하는 마이크로소프트 서피스 랩톱 울트라

이미지 출처: NVIDIA / Microsoft

이번 발표 무대에는 마이크로소프트 CEO 사티아 나델라(Satya Nadella)와 엔비디아 CEO 젠슨 황(Jensen Huang), 마이크로소프트 윈도우 및 디바이스 부문 총괄 파반 다불루리(Pavan Davuluri)가 함께 올라 양사의 긴밀한 하드웨어·소프트웨어 공동 엔지니어링 결과물을 공개했습니다. 양사는 데이터센터와 클라우드에 의존하던 기존 AI 실행 패러다임을 개인용 PC 단말로 전환하겠다는 로드맵을 천명했습니다.

엔비디아 RTX Spark 아키텍처와 128GB 통합 메모리

서피스 랩톱 울트라의 핵심은 엔비디아가 새롭게 선보인 온디바이스 AI 특화 프로세서인 'RTX Spark(RTX 스파크)' 시스템 온 칩(SoC)의 탑재입니다.

기존 모바일 PC 환경에서 대규모 파운데이션 모델을 실행할 때 가장 큰 걸림돌이었던 그래픽 메모리(VRAM) 용량 한계를 극복하기 위해, CPU와 GPU가 단일 메모리 풀을 동적으로 공유하는 최대 128GB 통합 메모리(Unified Memory) 아키텍처가 전격 적용되었습니다.

  • 블랙웰(Blackwell) 기반 RTX GPU 결합: 엔비디아의 최신 블랙웰 아키텍처 GPU와 고성능 멀티코어 CPU가 하나의 실리콘 패키지로 구성되어 풀스택 CUDA 가속 환경을 제공합니다.
  • 동적 통합 메모리 풀: CPU와 GPU가 단일 메모리 풀을 공유하며, 최대 128GB에 달하는 메모리를 워크로드에 맞춰 실시간으로 배분합니다.
  • 120B 모델 로컬 추론: 마이크로소프트와 엔비디아에 따르면, 최상위 사양 기준으로 최대 1페타플롭(초당 1,000조 회 연산)의 AI 연산 성능을 확보해 최대 1,200억(120B) 파라미터 규모의 모델을 로컬에서 직접 구동할 수 있습니다.

엔비디아가 RTX Spark 기준으로 제시한 수치에 따르면 90GB를 초과하는 초대형 3D 씬 렌더링, 12K 4:2:2 비디오 편집, 최대 100만 토큰 컨텍스트의 120B 파라미터 LLM 실행이 로컬에서 가능합니다.

윈도우 11 기반 로컬 AI 에이전트와 보안 격리 체계

단순한 텍스트 질의응답을 넘어 사용자의 복합 업무를 대행하는 '에이전틱 AI(Agentic AI)'를 안전하게 구동하기 위한 운영체제 차원의 변화도 함께 도입되었습니다.

마이크로소프트는 윈도우 11 환경에서 개인용 AI 에이전트가 파일 시스템, 브라우저, 로컬 개발 도구를 직접 조작할 때 발생할 수 있는 보안 위험을 원천 차단하기 위한 새로운 네이티브 보안 프리미티브(Security Primitives)를 구축했습니다.

  • 윈도우 실행 컨테이너와 엔비디아 오픈쉘(OpenShell): 윈도우 11의 네이티브 실행 컨테이너(Execution Containers)로 에이전트의 시스템 격리를 보장하며, 엔비디아 오픈쉘 런타임을 통해 에이전트 허용 작업 정책을 제어하고 프라이버시 기준에 맞춰 로컬 및 클라우드로 질의를 지능적으로 분기·라우팅합니다.
  • 클라우드 비용 및 지연 시간 절감: 애저(Azure) 등 데이터센터 인프라에서 처리하던 AI 작업 일부를 로컬 디바이스로 이전하여, 네트워크 지연을 줄이고 클라우드 비용 부담을 낮추려는 시도입니다.
  • 데이터 프라이버시 보호: 기업 내부 코드베이스나 사용자의 개인 작업 데이터가 외부 클라우드 서버로 전송되지 않고 로컬 메모리 안에서 처리되는 구조를 내세웠습니다.

가격 구성, 출시 일정 및 실사용 고려 사항

서피스 랩톱 울트라는 2026년 10월 7일 발표와 동시에 공식 사전 주문을 개시했으며, 첫 출고는 10월 16일부터 순차적으로 진행됩니다.

  • 가격 구성: 기본 모델의 시작가는 2,599달러이며, 메모리와 스토리지를 확장한 최상위 플래그십 구성은 5,900달러에 달합니다.
  • 전문가 및 엔터프라이즈 타깃: 고대역폭 메모리와 특화 실리콘 탑재에 따른 높은 출고가로 인해, 일반 소비자용 대중화 기기라기보다는 AI 연구원, 소프트웨어 엔지니어, 전문 크리에이터를 위한 전문가용 워크스테이션 성격이 강합니다.
  • 사양별 성능 제약: 발표에서 강조된 120B 파라미터 모델 로컬 구동과 1페타플롭 AI 연산 성능은 최상위 칩셋과 128GB 통합 메모리를 선택한 최고가 구성 기준입니다. 기본 2,599달러 모델의 경우 탑재 칩셋과 메모리 용량 차이로 인해 로컬에서 수용 가능한 모델 파라미터 크기에 제한이 있을 수 있음을 유의해야 합니다.

아울러 서피스 랩톱 울트라, 서피스 RTX Spark 데브 박스(Dev Box) 및 광범위한 Spark 생태계가 사전 주문과 함께 10월 16일부터 출고되며, 컴팩트 데스크톱 라인업은 11월에 추가 출시됩니다.

출처