IT | 엔비디아 에이전트 툴킷, DGX 스테이션에서 개인용 AI 에이전트 구축·실행 간소화
엔비디아(www.nvidia.co.kr)가 엔비디아 DGX 스테이션(NVIDIA DGX Station)에서 엔비디아 에이전트 툴킷(Agent Toolkit)을 활용해 개인용 AI 에이전트를 로컬 환경에서 손쉽게 구축하고 실행할 수 있다고 밝혔다.
엔비디아 DGX 스테이션은 AI 시대를 위한 데스크사이드 슈퍼컴퓨터로, 엔비디아 에이전트 툴킷을 활용하면 단 3단계로 설정을 완료하고 약 30분 만에 시스템을 실행할 수 있다.
DGX 스테이션에서 엔비디아 에이전트 툴킷은 엔비디아 네모클로(NemoClaw), 엔비디아 네모트론 3 울트라(Nemotron 3 Ultra) 오픈 모델, 에이전트가 활용할 수 있는 도구와 스킬로 제공되는 엔비디아 옴니버스(Omniverse) 라이브러리, 보안 런타임을 하나의 로컬 시스템에 통합한다. 이 과정에서 인터넷 연결은 필요하지 않다. 워크로드 규모가 확대되면 개발자는 여러 시스템을 연결해 동시에 더 많은 사용자와 에이전트, 더 큰 모델을 지원할 수 있다.
이를 통해 크리에이터와 엔지니어는 로컬에서 즉시 실행할 수 있는 시스템으로 자체 AI 인텔리전스를 직접 보유하고 운영할 수 있다. 모델, 에이전트, 도구로 구성된 전체 스택은 사용자의 자체 데이터와 지식을 활용해 맞춤화된 도메인 특화 ‘슈퍼 에이전트’를 구축하고 실행할 수 있는 플랫폼을 제공한다.
DGX 스테이션에서 제공되는 오픈 엔비디아 에이전트 툴킷 스택은 다음과 같이 구성된다.
l 엔비디아 네모클로는 맞춤형 자율 에이전트 구축을 위한 오픈 블루프린트로, 모델과 하네스, 런타임을 하나로 제공해 전문 분야에 특화된 에이전트를 개발하는 팀에 출발점을 제공한다.
l 엔비디아 네모트론 3 울트라는 5,500억 파라미터 규모의 프론티어 오픈 모델로, DGX 스테이션 GB300 시스템에서 실행되도록 최적화됐다. 각 팀이 자체 도메인에 맞게 조정할 수 있는 모델 계층 역할을 한다.
l 엔비디아 옴니버스 라이브러리는 에이전트의 스킬을 물리 시뮬레이션과 3D 에셋 워크플로우까지 확장해 크리에이티브·엔지니어링 전문가에게 범용 에이전트 역량을 뛰어넘는 도구를 제공한다.
l 엔비디아 오픈쉘(OpenShell)은 오픈소스 보안 런타임으로, 에이전트를 샌드박스 환경에 격리하고, 에이전트가 도구와 시스템, 데이터와 상호작용하는 방식을 규정한 정책에 따라 운영되도록 한다.
l 엔비디아 GB300 그레이스 블랙웰 울트라 데스크톱 슈퍼칩(Grace Blackwell Ultra Desktop Superchip)은 DGX 스테이션을 통해 데스크톱에서 데이터센터급 성능을 제공한다. 최대 20페타플롭스의 FP4 AI 컴퓨팅 성능과 748GB의 코히어런트 메모리를 갖춰 네모트론 울트라와 같은 대규모 모델을 실행할 수 있다.
l 엔비디아 커넥트X-8 슈퍼NIC(ConnectX-8 SuperNIC)는 DGX 스테이션에서 최대 800GB/s의 대역폭을 제공해 매우 빠르고 효율적인 네트워크 연결을 지원한다. 또한 최대 2대의 DGX 스테이션을 연결해 모델 용량과 성능을 더욱 확장할 수 있다.
대규모 운영 환경에서 효율성 강화
DGX 스테이션에서 에이전트를 대규모로 운영하는 팀은 근본적으로 달라진 비용 구조를 활용할 수 있다. 오픈 하네스에 맞게 튜닝된 네모트론 3 울트라는 하드웨어 구매 후 토큰당 비용 없이 최첨단 성능을 제공하므로, 사용자는 에이전트를 한 번만 구축하면 필요한 만큼 실행할 수 있다.
엔비디아는 블렌더(Blender)에 엔비디아 옴니버스 라이브러리를 통합하기 위한 블루프린트를 공개했다. 이를 통해 네모클로 에이전트는 호출 가능한 RTX 센서 시뮬레이션과 물리 도구를 활용해 피지컬 AI 워크플로우에 사용할 3D 장면을 준비할 수 있다.
디자이너와 엔지니어는 DGX 스테이션 하나에서 프론티어 모델, 오픈 하네스, 보안 런타임, 3D 도구 등 해당 워크플로우의 핵심 요소를 실행할 수 있다. 모든 요소는 서로 연결되며 오픈 블루프린트를 통해 배포할 수 있다.
프론티어 모델은 네모클로를 전문 서브 에이전트로 오케스트레이션할 수 있다. 이를 통해 옴니버스 도구와 블렌더에 직접 접근할 수 있는 DGX 스테이션의 로컬 에이전트에 도메인 특화 작업을 위임할 수 있다.
랭체인(LangChain)은 네모트론 3 울트라에 맞춰 자사의 딥 에이전트(Deep Agents) 하네스를 튜닝했다. 이를 통해 디자이너와 엔지니어는 훨씬 낮은 비용으로 벤치마크를 선도하는 에이전틱 성능을 구현할 수 있는 프로덕션 지원 경로를 확보할 수 있다.
누스 리서치(Nous Research)는 네모트론 3 울트라를 자사의 헤르메스 에이전트(Hermes Agent) 하네스에 맞게 파인 튜닝하고 프로덕션 워크로드에 도입했다. 이는 자체 AI 인텔리전스를 직접 보유하는 것의 가치를 보여주는 사례다. 개발자의 스택에 맞게 모델을 튜닝하면 특정 도메인에서 더 빠르고 뛰어난 역량을 갖춘 에이전트를 구현할 수 있다. 헤르메스 에이전트는 모델 컨텍스트 프로토콜(Model Context Protocol) 카탈로그에 블렌더도 추가해 팀이 에이전트에서 블렌더를 직접 활성화할 수 있도록 했다. 이는 DGX 스테이션에서 실행할 수 있는 도구 활용형 네모클로 에이전트의 실제 사례이다.
오픈클로(OpenClaw)를 운영하는 팀은 이 스택을 통해 활용 범위를 더욱 확장할 수 있다. 네모트론 3 울트라와 옴니버스 도구, DGX 스테이션의 로컬 추론 기능을 오픈클로 환경에 통합함으로써, 지속적으로 장시간 실행되는 오픈클로 에이전트가 이러한 기능을 계속 활용할 수 있다.
새로운 플레이북으로 신속한 개발·배포 지원
개발자가 네모클로와 듀얼 노드 배포 환경에서 별도 구성 없이 에이전트를 구축하고 실행하도록 지원하는 새로운 플레이북 2종이 제공된다.
l ‘분산 워크로드를 위한 DGX 스테이션 2대 연결(Connect Two DGX Stations for Distributed Workloads)’ 최대 2대의 DGX 스테이션 시스템을 연결해 확장 가능한 성능으로 강력한 모델을 실행하는 방법을 안내한다.
l ‘로컬 LLM 또는 듀얼 DGX 스테이션에서 네모클로 실행(Run NemoClaw With a Local LLM / On Dual DGX Station)’ DGX 스테이션에서 네모클로를 설정하는 방법을 단계별로 안내한다. 이를 통해 네모트론 울트라의 프론티어급 지능을 갖춘 에이전트를 즉시 활용할 수 있다.
엔비디아 DGX 스테이션은 에이수스(ASUS), 델 테크놀로지스(Dell Technologies), 익잭트(Exxact), 기가바이트(GIGABYTE), HP, MSI, 슈퍼마이크로(Supermicro)를 통해 제작되며 현재 주문할 수 있다.
DGX 스테이션에서 엔비디아 네모클로와 네모트론 울트라를 시작하는 방법은 여기에서 확인할 수 있다.
엔비디아, NVIDIA, 에이전트 툴킷, Agent Toolkit, DGX 스테이션, NVIDIA DGX Station, 에서, 개인용 AI, 에이전트, 구축, 실행, 간소화







