NVIDIA와 Perplexity가 이번에 공개한 핵심 숫자는 모델의 벤치마크 점수도, 데이터센터 GPU의 HBM 용량도 아닙니다. Windows용 Perplexity Portable Computer를 쓰려면 NVIDIA GeForce RTX 또는 RTX PRO GPU에 24GB 이상의 VRAM이 필요하다는 제품 자격요건입니다.
이 숫자는 ‘27B 모델은 정확히 24GB에서 구동된다’는 뜻이 아닙니다. NVIDIA는 문맥 길이, 양자화, 동시 실행 수, tokens/s나 전력 측정치를 이 글에서 공개하지 않았습니다. 다만 로컬 AI를 실제 앱으로 배포할 때 VRAM 용량이 추상적인 사양표가 아니라 사용자가 기능에 들어갈 수 있는지 가르는 명시적 경계가 됐다는 점은 확인됩니다.
NVIDIA가 확인한 사실
NVIDIA Blog는 9월 15일 KST에 Perplexity가 호환되는 NVIDIA GeForce RTX PC와 NVIDIA RTX PRO 워크스테이션을 위한 Windows 앱에 Portable Computer를 추가한다고 밝혔습니다. 기존 DGX Spark와 Linux RTX PC 지원을 Windows로 넓히는 발표입니다.
공식 글이 명시한 범위는 다음과 같습니다.
| 항목 | NVIDIA가 밝힌 내용 | 이 글만으로 말할 수 없는 것 |
|---|---|---|
| Windows 지원 | Portable Computer가 호환되는 Windows RTX PC와 RTX PRO 워크스테이션용 Perplexity 앱에 추가됨 | 모든 Windows PC·모든 RTX GPU에서 같은 성능으로 동작한다는 보장 |
| VRAM 자격요건 | GeForce RTX·RTX PRO GPU에서 24GB 이상 VRAM | 특정 GPU SKU, VRAM 규격·공급량, 실제 구매 대수 |
| 로컬 모델 예시 | Perplexity Computer에 맞게 post-training 되었고 NVIDIA RTX GPU에 최적화된 Qwen 3.8 27B를 예시로 듦 | 양자화 방식, 문맥 길이, 모델 전체 메모리 점유, 처리량 |
| 로컬·클라우드 경로 | 민감한 정보는 기기에 남고, 로컬에서 완료한 작업은 Perplexity Computer credits를 소모하지 않는다고 설명. 더 높은 수준의 추론이 필요하면 외부 전송 전 사용자에게 허가를 구한다고 설명 | 실제 사용자별 로컬 실행 비중, 클라우드 전환율, 비용 절감액 |
Portable Computer는 여러 단계의 작업을 계획·실행하는 에이전트라고 소개됐습니다. NVIDIA는 로컬 모델로 데이터를 분석하고 파일 간 정보를 모으며 반복 작업을 처리한다고 설명합니다. Microsoft Outlook·OneDrive·Word·Google Drive·Gmail·Slack·GitHub용 connector도 언급했습니다. 이는 제품이 단일 채팅창보다 파일·업무 흐름에 가까운 사용처를 겨냥한다는 회사 설명입니다.
M-INDEX의 판단 — 24GB는 모델 크기가 아니라 배포 경계입니다
M-INDEX는 이번 숫자를 메모리 수요 전망이 아니라 로컬 에이전트 제품의 첫 번째 공개 용량 경계로 봅니다. 이전에는 로컬 LLM 실행 여부가 모델 파일, 런타임, 양자화 설정을 직접 맞춰야 하는 사용자의 문제였다면, 이번에는 앱이 최소 VRAM을 표시해 지원 대상을 먼저 고릅니다.
이 변화가 의미하는 것은 간단합니다. 로컬 경로의 가치가 ‘모델을 한 번 실행해 보는 것’에서 민감한 파일을 다루는 반복 업무와 credits를 쓰지 않는 작업으로 옮겨갈수록, VRAM은 성능 비교표의 숫자보다 사용 가능한 서비스 등급을 나누는 조건이 됩니다. 24GB 이상 장비가 이 특정 앱의 로컬 경로에 들어가는지 여부는 확인 가능하지만, 그 경계가 곧바로 GPU 판매·VRAM 비트 수요·메모리 업체 매출을 뜻하지는 않습니다.
특히 이 발표만으로 HBM 수요를 연결해서는 안 됩니다. 이 글은 데이터센터에서 토큰당 KV 캐시를 계산한 DeepSeek V4.1 Flash 분석과 다른 질문을 다룹니다. 여기에는 토큰당 캐시 크기, 서버당 가속기 수, 데이터센터 HBM·서버 DRAM·SSD 트래픽 수치가 없습니다. 따라서 ‘Windows 로컬 에이전트 지원 확대 = HBM 수요 증가’나 ‘24GB 요건 = 특정 메모리 규격 판매 증가’라는 결론은 현재 근거를 넘습니다.
24GB라는 숫자를 과장하지 말아야 하는 이유
첫째, NVIDIA는 24GB를 Portable Computer의 지원 자격으로 제시했지만 Qwen 3.8 27B의 정확한 모델 포맷이나 실행 조건을 공개하지 않았습니다. 같은 27B 모델이라도 정밀도·양자화·문맥 길이·동시 작업 수에 따라 필요한 메모리가 달라질 수 있습니다. 그러므로 24GB를 모델 가중치나 KV 캐시의 정확한 용량으로 바꾸면 안 됩니다.
둘째, NVIDIA의 설명은 기능·개인정보·credit 정책에 대한 회사 발표입니다. 로컬 경로가 실제로 더 빠른지, 품질이 어떤지, 얼마나 많은 작업이 클라우드로 넘어가는지에 대한 독립 측정은 이 원문에 없습니다. 사용자는 고급 리서치·추론을 위해 클라우드 모델을 선택할 수 있고, Portable Computer도 외부 전송 전에 사용자의 허가를 받는다고 설명합니다.
셋째, 24GB는 현재 앱의 공개 기준일 뿐 영구적인 산업 기준이라는 증거는 아닙니다. 추후 더 작은 모델·다른 양자화·다른 런타임이 낮은 용량에서 같은 업무를 처리하거나, 반대로 실제 업무에서 더 긴 문맥·더 높은 동시성이 필요해 24GB를 넘어설 수 있습니다.
반증 조건과 다음 확인 숫자
M-INDEX의 ‘VRAM이 제품 배포 경계가 된다’는 해석은 다음 상황에서 낮춰야 합니다.
- Portable Computer가 곧 더 낮은 VRAM 요건으로 같은 로컬 업무를 지원하거나, 24GB 이상 조건이 실질적 기능 차이를 만들지 않을 때
- 실제 사용에서 대부분의 복잡한 업무가 클라우드로 전환돼 로컬 경로의 비중이 낮을 때
- 독립 측정에서 Qwen 3.8 27B의 실제 구성·문맥·동시성 조건이 24GB 요건과 다른 사용자 경험을 만들 때
다음에 확인할 숫자는 지원 GPU 목록, 모델 포맷·양자화, 문맥 길이, 동시 작업 수, 실제 tokens/s와 전력, 로컬 완료 작업 비중, 클라우드 전환율입니다. 그 다음에야 24GB라는 제품 자격요건이 일시적인 설치 조건인지, 반복 업무용 로컬 AI의 지속적인 용량 계층인지 평가할 수 있습니다.
공식 근거
- NVIDIA Blog — Perplexity Portable Computer Is Now Available on Windows, Powered by NVIDIA RTX — Windows RTX 지원, 24GB 이상 VRAM 자격요건, Qwen 3.8 27B 예시, 기기 내 정보·credits·클라우드 허가 설명
이 글은 NVIDIA의 공식 발표에 근거한 교육용 분석입니다. 독립 성능 측정, GPU 출하·매출, VRAM·HBM 수요나 특정 종목의 매수·매도를 판단한 자료가 아닙니다.
밑줄 친 말은 용어 위키로 이어집니다.