GPD Win Max 3는 게임기인가, 로컬 AI 머신인가

4℃

GPD WIN MAX 3 what we know so far

GPD가 9월 2일 인디고고에서 Win Max 3의 펀딩을 시작합니다. 

AMD Strix Halo를 넣은 9인치 노트북형 게임기이고, 구성은 세 가지입니다.

그런데 이 제품을 게임기로 볼 때와 로컬 AI 머신으로 볼 때 "사야 할 구성"이 좀 달라집니다.

 

구성 가격(USD) 원화 환산
Ryzen AI Max+ 388 / 32GB / 1TB $1,750 약 241만원
Ryzen AI Max+ 388 / 64GB / 2TB $2,246 약 309만원
Ryzen AI Max+ 395 / 128GB / 2TB $3,499 약 481만원

 

세 구성의 GPU는 전부 같습니다. 388과 395 모두 Radeon 8060S 40CU, 최대 2.9GHz입니다. 다른 것은 CPU 코어 수(8 대 16)와 L3 캐시(32MB 대 64MB), 그리고 메모리 용량뿐입니다.

즉 최상위 구성에 $1,749를 더 내면 무엇을 얻느냐가 이 제품의 핵심 질문입니다. 게임 관점과 AI 관점에서 따로 따져 보겠습니다.

 

  1. 게임기로 볼 때

Radeon 8060S는 1080p 60fps급입니다

여러 매체와 리뷰어의 실측을 모아 비교해보면..

게임 조건 평균 FPS 출처
사이버펑크 2077 1080p High, 업스케일 없음 66.8 RandomGaminginHD (Tom's Hardware 인용)
사이버펑크 2077 1080p RT Ultra, FSR3 Quality 45.4 동일
엘든 링 1080p High 59.6 동일
배틀필드 6 1080p High, FSR Native AA 86.7 동일
GTA 5 Enhanced 1080p Very High + RT 76.9 동일
CS2 1080p High 263.7 동일
사이버펑크 2077 1440p Ultra, FSR4 Quality, 120~140W 66 wccftech (BOSGAME M5)
사이버펑크 2077 1440p RT Ultra, FSR4.1 Quality 33 동일
Alan Wake 2 1440p Low 네이티브, 약 50W 51.65 Digital Foundry (GPD Win 5)

정리하면 네이티브 1080p High에서 60fps 언저리, FSR을 켜면 1440p에서 60fps 수준입니다. Digital Foundry는 같은 칩을 쓴 GPD Win 5를 두고 PS5 대비 70~90%, ROG Ally X의 약 2배라고 평가했습니다. 휴대기기 기준으로는 최상위권입니다.

성능의 대부분은 45~55W에서 이미 나옵니다

이 칩의 중요한 특성입니다. TDP를 올려도 성능이 비례해 오르지 않습니다.

게임 (1080p) 55W 85W 120W 55W→120W
사이버펑크 2077 High 53 62 66 +24.5%
Metro Exodus EE Ultra 51 59 63 +23.5%
Red Dead Redemption 2 High 55 58 66 +20.0%
GTA V Enhanced Very High 105 118 137 +30.5%
Black Myth: Wukong High 71 78 84 +18.3%
Talos Principle Ultra 102 113 117 +14.7%

출처인 Strix Halo 위키는 85W를 스위트스팟으로 보고 120W 이상은 수확체감이라고 정리했습니다. The Phawx도 "Strix Halo는 약 45W까지 깔끔하게 스케일링하고 이후 평탄해진다"고 했습니다.

 

Win Max 3는 배터리 구동 시 45W로 제한됩니다. 언뜻 큰 제약처럼 보이지만 위 곡선을 보면 45~55W에서 이미 대부분의 성능이 나옵니다. 반대로 말하면 110W라는 스펙은 배터리 게이밍에 거의 의미가 없습니다. 게다가 110W 지속은 착탈식 외장 팬 모듈을 달아야 나오므로, 들고 다니면서 110W를 쓰는 조합은 성립하지 않습니다.

 

저와트 쪽은 상황이 다릅니다. ETA Prime 측정에서 18W에서는 8060S 클럭이 600MHz를 못 넘고 25W에서도 1,000MHz 미만이었습니다. 최대 2,900MHz에 한참 못 미칩니다. 40CU가 있어도 저와트에서는 이를 먹일 전력이 없습니다.

 

2400×1504 165Hz 패널은 이 GPU에 과합니다

9.06인치 2400×1504는 픽셀 수 3.61M으로 1080p의 1.74배이고 1440p(3.69M)와 거의 같습니다. 위 실측을 보면 이 GPU가 1440p급 해상도에서 최신 AAA를 네이티브 60fps로 돌리기는 어렵습니다. FSR Quality나 Balanced를 켜야 60fps에 닿습니다.

 

165Hz를 채울 수 있는 것은 e스포츠 타이틀뿐입니다. CS2가 1080p High에서 263fps, GPD 자체 측정으로 Apex Legends가 190fps 이상입니다. AAA 타이틀에서 165Hz는 나오지 않습니다.

 

다만 이 패널 자체는 좋은 물건입니다. 313PPI에 상시 650니트·피크 1,050니트, DCI-P3, HDR10, 고릴라글래스 6입니다. 게임 스펙이라기보다 작업용 스펙에 가깝습니다.

 

게임에서 388과 395는 사실상 같습니다

GPU가 동일하고 TDP 범위도 같으므로, 남는 변수는 CPU 코어 수와 L3 캐시입니다.

8060S는 45~110W 어디에서도 GPU 병목입니다. GPU 병목 상황에서 CPU 코어 수는 거의 영향을 주지 않습니다. 참고로 GamersNexus가 측정한 Ryzen 9 9950X(16C)와 Ryzen 7 9700X(8C) 비교에서, CPU 병목이 걸리는 1080p 외장 GPU 환경에서조차 16코어가 8코어 대비 1~4% 우위에 그쳤습니다. 발더스 게이트 3은 111 대 108이었습니다.

 

HotHardware도 "395의 추가 CPU 코어는 대부분의 게임 워크로드에 이득이 되지 않는다"고 정리했습니다.

 

다만 L3 캐시가 64MB에서 32MB로 절반이라는 점은 검증되지 않았습니다. 코어 수보다 이쪽이 게임에 영향을 줄 여지가 있고, 시뮬레이션이나 전략 장르에서 차이가 날 가능성을 배제할 수 없습니다. 388 탑재 제품이 아직 없어 직접 비교 데이터가 존재하지 않습니다.

 

게임에 32GB 넘는 메모리의 잇점이 별로 없는것 같습니다

지금까지 나온 8060S 게임 실측은 전부 32GB 시스템(ROG Flow Z13, Asus TUF A14, GPD Win 5)에서 나왔고, 1080p~1440p AAA에서 VRAM 부족 증상을 보고한 리뷰가 없습니다. 8060S의 렌더링 성능 자체가 1440p 60fps급이라, 그 이상 VRAM을 요구하는 설정은 애초에 프레임이 안 나옵니다.

AMD의 Variable Graphics Memory 공식 가이드도 이를 뒷받침합니다. 권장 프리셋에서 **게이머는 Medium, AI 개발자는 Custom(75%)**으로 나뉘어 있고, 문서 전체가 AI 추론에 초점을 맞추고 있으며 게이밍 측면의 VRAM 증량 이점은 언급하지 않습니다.

단, 32GB와 128GB를 직접 비교한 게임 측정은 찾지 못했습니다. 정황 근거입니다.

 

경쟁 기기와 비교

기기 SoC / GPU 화면 무게 배터리 현재 가격
GPD Win Max 3 Max+ 388/395, 8060S 40CU 9.06" 2400×1504 AMOLED 165Hz 815g~1,220g 97Wh 탈착 $1,750~
GPD Win 5 (자사) Max 385(8050S 32CU) 또는 395 7" 1920×1080 120Hz 565g+ 80Wh 외장 $2,429 (정가 $2,999)
AYANEO NEXT 2 Max 385 또는 395, 8060S 9.06" 2400×1504 OLED 165Hz 1.4kg 116Wh $1,799(32GB/1TB) ~ $4,299(128GB/2TB)
OneXFly Apex Max 385 또는 395 8" 1920×1200 120Hz 706g+ 85Wh 교체 $1,399~$2,299
Lenovo Legion Go 2 Ryzen Z2 Extreme 8.8" 1920×1200 OLED 144Hz 922g 74Wh $1,999.99
MSI Claw 8 EX AI+ Intel Arc G3 Extreme 8" 1920×1200 120Hz 785g 80Wh $1,799.99
ROG Xbox Ally X20 Ryzen AI Z2 Extreme 7.4" 1080p OLED 120Hz 756g 80Wh $1,299.99
Steam Deck OLED Van Gogh (RDNA2 8CU) 7.4" 1280×800 OLED 90Hz 640g 50Wh $789 (512GB)

두 가지가 눈에 띕니다.

 

첫째, 자사 제품인 Win 5 팀킬. Win 5는 7인치 1080p에 현재 $2,429인데, Win Max 3는 9인치 2400×1504 165Hz에 $1,750부터입니다. 더 크고 더 강하고 더 쌉니다. GPD가 Win 5를 $2,999에서 $2,429로 할인 중인 것도 이 맥락으로 보입니다. AMD가 2026년 1월 발표한 388·392 SKU가 이 구도를 만들었습니다. 40CU GPU를 유지하면서 CPU 코어만 줄여 가격을 낮춘 칩입니다.

 

둘째, AYANEO NEXT 2가 패널까지 동일한 직접 경쟁자입니다. 9.06인치 2400×1504 OLED 165Hz로 같은 패널이고 배터리는 116Wh로 더 큽니다. 대신 무게가 1.4kg이고 가격은 32GB 기준 $1,799, 128GB 기준 $4,299입니다. GPD가 양쪽 끝에서 모두 저렴합니다.

 

게임기로서의 결론

게임만 할 거라면 $1,750짜리 388/32GB 구성이 답입니다. 위쪽 구성으로 올라가도 프레임은 오르지 않습니다. 이 가격에 9인치 165Hz AMOLED와 PS5 70~90%급 성능은 경쟁력이 있습니다.

 

2. 로컬 AI 머신으로 볼 때

96GB VRAM을 쓸 수 있습니다

Strix Halo는 CPU와 iGPU가 메모리를 공유합니다. Windows의 AMD Variable Graphics Memory로 128GB 모델에서 최대 96GB를 GPU 전용 메모리로 할당할 수 있습니다. 64GB 모델은 48GB입니다. 리눅스에서 GTT로 설정하면 110~124GB까지 올렸다는 보고도 있습니다.

그래픽카드로 96GB VRAM을 확보하려면 RTX PRO 6000(96GB)이 필요하고 $13,250(약 1,822만원)입니다.

다만 대역폭이 속도를 결정합니다.

LLM 토큰 생성 속도는 연산량이 아니라 메모리 대역폭에 거의 선형 비례합니다. 매 토큰마다 모델 가중치를 읽어야 하기 때문입니다.

Strix Halo의 이론상 대역폭은 256GB/s(256비트 × 8000MT/s ÷ 8)입니다. 실측은 이에 못 미쳐 iGPU 실효 대역폭이 약 210~215GB/s로 측정됩니다.

플랫폼 메모리 대역폭 128GB급 가격
Strix Halo 128GB 통합 256GB/s(실측 약 210) $3,499
NVIDIA DGX Spark 128GB 통합 273GB/s $4,699
Mac Studio M5 Max 128GB 구성 614GB/s 약 $5,100
Mac Studio M5 Ultra 96GB 기본 1.2TB/s $5,499~
RTX 3090 (중고) 24GB 936GB/s 약 $1,100
RTX 5090 32GB 1,792GB/s 약 $4,300
RTX PRO 6000 96GB 1,792GB/s $13,250

대역폭은 그래픽카드의 1/4~1/8이고 대신 용량이 큽니다. 빠른 기계가 아니라 그래픽카드에 안 들어가는 큰 모델을 어떻게든 돌리는 기계입니다.

 

그래서 MoE 모델이라야 쓸 만합니다

이 플랫폼에서 가장 중요한 특성입니다. AMD도 공식 블로그에서 "GPT-OSS 120B가 Llama 3 70B보다 약 10배 빠르다"고 밝혔습니다. 파라미터 총량이 아니라 활성 파라미터가 속도를 결정하기 때문입니다.

같은 리뷰에서 같은 조건으로 측정한 대조군입니다.

측정자 Dense 생성(t/s) MoE 생성(t/s) 배율
StorageReview (HP Z2 Mini G1a) Gemma3 70B 4.24 gpt-oss 120b 약 40 9.4배
AkitaOnRails (MS-S1 Max) qwen2.5 72B 4.5 qwen3.5 122B 19.2 4.3배
nishtahir (GMKtec EVO-X2) qwen3 32B 9.43 gpt-oss 120b 33.05 3.5배

 

70B급 dense 모델은 초당 3~5토큰으로 대화형에 못 씁니다. 반면 gpt-oss-120b(모델 크기 63.4GB)는 40토큰/초 안팎이 나옵니다. Qwen3 30B-A3B는 Vulkan RADV에서 85토큰/초까지 나옵니다.

 

긴 컨텍스트에서는 크게 떨어집니다. Qwen3-30B-A3B를 13만 토큰 깊이에서 재면 85 → 12.5t/s(Vulkan), ROCm은 64 → 5.0t/s로 내려갑니다. 짧은 벤치마크를 실사용 기대치로 삼으면 안 됩니다.

 

프롬프트 처리는 약점입니다. DGX Spark와 gpt-oss 120b로 비교하면 토큰 생성은 38.6 대 34.1로 비슷한데 프롬프트 처리는 1,723 대 340으로 5배 차이입니다.

 

NPU 50 TOPS는 LLM에 쓰이지 않습니다.

llama.cpp, Ollama, LM Studio는 NPU를 쓰지 않습니다. 전부 iGPU(ROCm 또는 Vulkan)나 CPU만 씁니다. AMD 자신의 "128B 파라미터 모델 실행" 블로그도 Vulkan llama.cpp 기반임을 명시합니다.

NPU를 실제 쓰는 AMD Lemonade Server 실측에서는 Qwen3-8B 기준 NPU 8.2t/s, iGPU 19.7t/s로 iGPU가 2.4배 빨랐습니다. NPU는 첫 응답이 빠른 대신 지속 처리량이 낮습니다. NPU가 시스템 DRAM의 절반 미만만 접근 가능하다는 제약도 있어 대형 모델에는 무관합니다.

 

1년 전이라면 "Framework Desktop이 훨씬 싸다"가 결론이었을 겁니다.

제품 128GB 가격 상태
Framework Desktop DIY $3,449 (출시가 $1,999) 품절
GPD Win Max 3 $3,499 9/2 캠페인
Minisforum MS-S1 Max $3,799 (정가 $4,749) 9월 중순 출하
AYANEO NEXT 2 $4,299 –
NVIDIA DGX Spark $4,699 (인상 전 $3,999) 출하 중
Mac Studio M5 Max 약 $5,100 9/22 출하

 

Framework Desktop 128GB는 출시가 $1,999에서 $3,449로 73% 올랐고 현재 품절입니다. DGX Spark는 17.5%, RTX PRO 6000은 55% 올랐습니다. NVIDIA는 사유를 "업계 전반의 메모리 공급 제약"이라고 밝혔습니다.

 

GPD도 같은 설명을 했습니다. 전작 Win Max 2의 64GB/2TB가 $1,462였는데 신작은 $2,246으로 54% 올랐고, "256비트 메모리 버스 구조상 최소 32GB LPDDR5x가 강제되어 $1,750보다 싸게 만들 수 없다"고 밝혔습니다.

 

결과적으로 Win Max 3의 128GB 구성은 Framework Desktop과 거의 같은 값에 화면·키보드·배터리가 붙은 셈이 됐습니다.

 

로컬 AI 머신으로서의 결론

AI가 목적이라면 $3,499짜리 395/128GB만 의미가 있습니다. 32GB(VRAM 16GB)로는 14B급이 한계이고, 64GB(VRAM 48GB)면 30B급 MoE까지입니다. gpt-oss-120b는 63.4GB라 128GB 구성이 필요합니다.

 

정리하면 이렇게 됩니다.

  게임 관점 로컬 AI 관점
388 / 32GB / $1,750 최적 14B급까지
388 / 64GB / $2,246 프레임 동일 30B MoE (85t/s)
395 / 128GB / $3,499 프레임 동일 gpt-oss 120b (40t/s)

 

$1,750과 $3,499의 차액 $1,749는 전액 AI 지출입니다. 게임 프레임은 1도 오르지 않습니다. 반대로 AI가 목적이면 165Hz AMOLED, 컨트롤러, 자이로, 홀 트리거는 값을 치르고 받은 부속품입니다.

즉 이 제품은 게임기와 AI 머신 중 하나를 고르는 물건이 아니라, 어느 쪽을 사느냐에 따라 다른 제품을 사는 것에 가깝습니다.

 

그런데 AI 용도라면 9인치일 이유가 없습니다.

LLM 추론은 iGPU를 수 분간 100%로 돌리는 작업입니다. 같은 칩이라도 폼팩터에 따라 지속 TDP가 크게 다릅니다. Framework Desktop은 120W를 지속하고 17시간 연속 부하에서 기본 쿨링으로 충분했습니다. HP Z2 Mini G1a는 gpt-oss-120b 추론 중 GPU 약 100W에 51~54°C를 유지했습니다.

 

Win Max 3는 내장 냉각으로 100W, 110W는 외장 팬 모듈을 달아야 합니다. DROiX의 사전 리뷰에서 리뷰 유닛은 기본 80W로 동작했고 배터리 모드에서는 45W로 제한됐으며, 소음은 퍼포먼스 모드에서 최대 70dB였습니다. 배터리 모듈과 팬 모듈이 같은 후면 베이를 쓴다는 점도 걸립니다(동시 장착 가능 여부는 출처마다 서술이 엇갈립니다).

 

우려되는 사례도 있습니다. Level1Techs 포럼에 ROG Flow Z13에서 지속 추론 부하 중 하드 파워오프가 발생한다는 계측 보고가 올라와 있습니다. 다만 해당 게시물은 접근이 막혀 제목과 검색 요약만 확인했습니다. 데스크톱·미니PC 폼팩터에서는 같은 보고가 없습니다.

 

배터리로 LLM을 돌리는 것은 현실적이지 않습니다. 97Wh를 60~100W로 나누면 이론상 1~1.6시간이고, 배터리 모드에서는 TDP가 45W로 내려가 토큰 속도도 함께 떨어집니다. 100W USB-PD로는 110W 지속을 감당할 수 없습니다.

정리하면 AI 용도로 쓰려면 전원을 꽂고 팬 모듈을 달아야 하는데, 그 상태면 휴대성은 사라집니다. 같은 돈으로 미니PC를 사면 냉각과 안정성이 낫습니다.

 

eGPU로 보완할 수 있나?

GPD는 G2 그래픽 독($399, 약 55만원)을 함께 팝니다. 800W PSU 내장에 풀렝스 PCIe 슬롯이 있어 RTX 40·50 시리즈를 꽂을 수 있습니다.

 

다만 연결 방식이 변수입니다. DROiX 측정에서 RTX 3090을 물렸을 때 USB4 v2.0으로 연결한 GPD BOX는 Forza Horizon 6 1440p High에서 62fps, USB4 1세대인 GPD Win 5는 40fps로 35% 차이가 났습니다. Win Max 3는 USB4 40Gbps 포트만 있고 MCIO 8i 포트가 없습니다. Win 5와 비슷한 병목이 예상되지만 실측은 없습니다.

 

결론은..

게임만 한다면 → $1,750 (388/32GB) 9인치 165Hz AMOLED에 PS5 70~90%급 성능을 이 가격에 얻습니다. Win 5($2,429)보다 크고 강하고 쌉니다. 위 구성으로 올려도 프레임은 그대로입니다.

로컬 AI가 목적이고 휴대해야 한다면 → $3,499 (395/128GB) gpt-oss-120b를 40토큰/초로 돌리면서 들고 다닐 수 있는 다른 선택지가 마땅치 않습니다. 다만 지속 추론에는 전원과 팬 모듈이 필요합니다.

로컬 AI가 목적인데 휴대는 필요 없다면 → 이 제품이 아닙니다 미니PC나 Framework Desktop 계열이 냉각·소음·안정성에서 낫습니다. 다만 지금은 대부분 품절이거나 더 비쌉니다.

24GB에 들어가는 모델만 쓴다면 → 중고 RTX 3090 936GB/s로 대역폭이 3.7배이고 중고가가 약 $1,100입니다. 32B급까지는 이쪽이 훨씬 빠르고 쌉니다.

중간 구성 $2,246 (388/64GB)은 애매합니다. 게임에는 32GB면 충분하고, AI로는 30B급 MoE까지만 됩니다. 30B MoE를 85토큰/초로 쓰는 것이 정확히 필요한 경우에만 맞습니다.

 

 

참고링크

게임 성능

경쟁 기기

로컬 AI 성능

 

번역, 정리: 클로드

0 0