IT | 엔비디아 RTX GPU, 로컬 AI에서 프론티어급 큐원3.8-27B 코딩 에이전트 구현
엔비디아(www.nvidia.co.kr)가 엔비디아(NVIDIA) RTX GPU에서 큐원3.8-27B(Qwen3.8-27B)를 지원하며, 프론티어급 로컬 코딩 에이전트를 빠르고 효율적으로 실행할 수 있도록 한다.
큐원3.8-27B는 큐원3.8-맥스(Qwen3.8-Max)의 로컬 동반 모델로, 270억 파라미터 규모의 오픈 모델이다. 단일 GPU에서 실행할 수 있으며, 로컬 파일과 도구, 프로젝트 컨텍스트를 활용하는 반응성 높은 코딩 워크플로우를 지원한다. 개발자는 민감한 코드와 독점 데이터, 프로젝트 컨텍스트를 자체 시스템에 유지하면서 개발 과정 전반에서 강력한 AI 지원을 활용할 수 있다.
이 모델은 현재 엔비디아 RTX PRO GPU와 엔비디아 지포스(GeForce) RTX 5090을 비롯한 엔비디아 RTX GPU에서 지원된다. 다중 토큰 예측(multi-token prediction, MTP)으로 최적화된 큐원3.8-27B는 MTP를 적용할 경우 단일 지포스 RTX 5090에서 초당 131토큰의 성능을 제공한다. 이에 따라 에이전틱 코딩, 도구 사용, 장시간 개발 작업 등에서도 빠른 로컬 추론을 구현할 수 있다.
개발자는 라마.cpp(llama.cpp), 올라마(Ollama), 언슬로스(Unsloth), LM 스튜디오 바이오닉(LM Studio Bionic)을 통해 즉시 활용할 수 있으며, 이들 모두 엔비디아 RTX GPU에서 큐원3.8-27B를 지원한다. 엔비디아 RTX의 성능과 쿠다(CUDA) 소프트웨어 생태계, 기존 오픈소스 도구를 결합해 새로운 모델을 폭넓게 지원하고, 빠른 반응성을 갖춘 로컬 에이전틱 코딩 워크플로우를 위한 기반을 제공한다.
한편 큐원3.8-27B는 DGX 스파크(DGX Spark)와 DGX 스테이션(DGX Station)에서도 지원된다. 모든 엔비디아 로컬 AI 디바이스의 NVFP4 지원을 비롯한 추가 최적화 기능도 곧 공개될 예정이다. 이를 통해 큐원3.8-27B는 엔비디아의 상시 구동 개인용 AI 시스템에서 프론티어급 로컬 코딩 에이전트를 구현할 수 있다.
PC와 개인용 AI 시스템을 넘어, 엔비디아 젯슨(Jetson)에서도 큐원3.8-27B를 지원해 활용 범위를 엣지 환경으로 확장한다. 강력한 추론 역량과 에이전틱 역량을 갖춘 큐원3.8-27B는 MTP를 활용한 추측 디코딩(speculative decoding)을 통해 엣지 환경에서도 빠르고 반응성 높은 로컬 추론을 지원한다.
엔비디아, NVIDIA, RTX GPU, 로컬 AI에서, 프론티어급, 큐원3 8-27B, Qwen3.8-27B, 코딩, 에이전트, 구현








