Perplexity·NVIDIA, 로컬 AI 에이전트 'Portable Computer' 공개
Perplexity가 엔비디아와 함께 로컬에서 작동하는 AI 에이전트 'Portable Computer'를 공개했다. DGX Spark 등에서 구동되며, 로컬 처리 작업은 토큰 비용이 없다.
Perplexity가 엔비디아와 함께 로컬에서 작동하는 AI 에이전트 'Portable Computer'를 공개했다. DGX Spark 등에서 구동되며, 로컬 처리 작업은 토큰 비용이 없다.
핵심 요약
Perplexity와 NVIDIA가 2026년 8월 25일 로컬에서 실행되는 AI 에이전트 제품 'Portable Computer'를 공동으로 발표했다(공식 블로그).
이 제품은 NVIDIA DGX Spark 등 GB10 기반 하드웨어나, VRAM 24GB 이상을 갖춘 x86 PC(Ubuntu)에서 로컬로 작동한다. 로컬에서 처리되는 작업에는 토큰 비용이 부과되지 않으며(zero token cost), 필요한 경우에만 클라우드로 작업이 전환된다.
주요 기능
1. 로컬 실행 하드웨어
Portable Computer는 두 가지 방식으로 로컬 실행 환경을 지원한다.
| 실행 환경 | 조건 |
|---|---|
| NVIDIA 전용 하드웨어 | DGX Spark 등 GB10 기반 하드웨어 |
| 일반 x86 PC | VRAM 24GB 이상, Ubuntu 운영체제 |
DGX Spark와 같은 NVIDIA 전용 장비뿐 아니라, 조건을 충족하는 일반 PC에서도 실행 가능하다는 점이 특징이다.
2. 구동 모델: Qwen 3.8 27B / PPLX 27B
Portable Computer는 Qwen 3.8 27B 모델 또는 이를 기반으로 Perplexity가 자체적으로 파인튜닝한 'PPLX 27B' 모델로 구동된다. 두 모델 모두 로컬 하드웨어에서 실행 가능한 규모로 설계됐다.
3. 로컬 우선 과금 구조 (Zero Token Cost)
가장 핵심적인 특징은 과금 방식이다. 로컬 하드웨어에서 처리되는 작업에는 토큰 비용이 발생하지 않는다. 클라우드 리소스가 필요한 작업일 때만 클라우드로 전환되어 처리된다. 클라우드 전환 시 구체적인 과금 정책은 공식 자료에 별도로 명시되지 않았다.
사용성 분석
Portable Computer의 핵심 가치 제안은 '상시 실행되는 AI 에이전트'를 로컬 환경에서 운용할 때 발생하는 지속적인 API 비용 부담을 줄이는 데 있다. 다만 이를 위해서는 NVIDIA DGX Spark 같은 특정 하드웨어 또는 VRAM 24GB 이상의 x86 PC(Ubuntu)라는 조건을 충족해야 한다.
이러한 사양 조건을 고려하면, 일반 소비자용 노트북보다는 워크스테이션급 환경을 이미 보유했거나 AI 에이전트를 반복적으로 운용해야 하는 개발자, 기업 사용자에게 적합한 구성으로 볼 수 있다.
장점
- 로컬 처리 작업에 토큰 비용이 발생하지 않아 반복적인 에이전트 운용 비용을 절감할 수 있다
- 필요한 경우에만 클라우드로 전환되는 하이브리드 구조로 유연성을 갖췄다
- NVIDIA DGX Spark뿐 아니라 VRAM 24GB 이상의 일반 x86 PC에서도 실행 가능해 전용 장비 없이도 도입할 수 있다
- NVIDIA와의 공동 개발로 GB10 기반 하드웨어에 최적화된 로컬 구동이 가능하다
단점 및 한계
- NVIDIA DGX Spark 또는 VRAM 24GB 이상이라는 하드웨어 조건이 있어 일반 소비자에게는 진입장벽이 있다
- 구동 모델이 27B(Qwen 3.8 27B / PPLX 27B) 규모로, 하이브리드 설계상 일부 작업은 여전히 클라우드 전환이 필요할 수 있다
- 가격 정책, 정식 출시 일정 등 구체적인 상용화 정보가 아직 공개되지 않았다
- 공식 자료에서 확인된 사양 외의 세부 성능 지표는 공개되지 않았다
전망
Perplexity와 NVIDIA의 이번 협업은 클라우드 기반 AI 에이전트 운용 시 발생하는 지속적인 토큰 비용 문제에 대한 대안적 접근을 보여준다. 로컬 우선(local-first) 처리와 필요 시 클라우드 전환을 결합한 하이브리드 구조는, AI 에이전트가 가정이나 사무실에서 상시 실행되는 환경으로 확장될 때 비용 구조 측면에서 의미 있는 시도로 평가할 수 있다.
결론
Portable Computer는 로컬 실행을 통해 토큰 비용 부담 없이 AI 에이전트를 운용할 수 있는 방식을 제시한 제품이다. NVIDIA DGX Spark 또는 VRAM 24GB 이상의 x86 PC(Ubuntu)라는 하드웨어 조건이 필요한 만큼, 일반 소비자보다는 AI 에이전트를 지속적으로 운용해야 하는 개발자와 기업 사용자에게 적합하다.
장점
- 로컬 처리 시 토큰 비용 없음 (Zero Token Cost)
- 필요 시에만 클라우드로 전환되는 유연한 하이브리드 구조
- DGX Spark뿐 아니라 VRAM 24GB 이상 일반 x86 PC에서도 실행 가능
- NVIDIA와 공동 개발로 GB10 기반 하드웨어 최적화 기대
단점/한계
- DGX Spark 또는 VRAM 24GB 이상이라는 하드웨어 진입장벽 존재
- 27B 규모 로컬 모델로 인해 일부 작업은 클라우드 전환이 필요할 수 있음
- 가격 정책, 정식 출시 일정 등 구체적 상용화 정보 미공개
참고 자료
댓글0개
주요 기능/특징
1. NVIDIA DGX Spark(GB10 기반) 또는 VRAM 24GB 이상 x86 PC(Ubuntu)에서 로컬 실행 2. Qwen 3.8 27B 또는 자체 파인튜닝 모델 'PPLX 27B'로 구동 3. 로컬 처리 작업은 토큰 비용 없음(Zero Token Cost) 4. 필요한 경우에만 클라우드로 전환되는 하이브리드 구조 5. Perplexity와 NVIDIA 공동 개발
핵심 인사이트
- Perplexity와 NVIDIA가 2026년 8월 25일 로컬 실행 AI 에이전트 'Portable Computer'를 공동 발표했다
- NVIDIA DGX Spark 등 GB10 기반 하드웨어뿐 아니라 VRAM 24GB 이상 x86 PC(Ubuntu)에서도 실행 가능하다
- 로컬에서 처리되는 작업은 토큰 비용이 부과되지 않는 zero token cost 구조를 채택했다
- 필요한 경우에만 클라우드로 전환되는 하이브리드 방식으로 설계됐다
- Qwen 3.8 27B 또는 자체 파인튜닝 모델 PPLX 27B로 구동된다
- 지속적인 API 비용 부담 없이 AI 에이전트를 상시 운용하려는 수요를 겨냥한 제품이다
- 특정 하드웨어 조건이 필요해 일반 소비자보다는 개발자·기업 사용자에게 적합하다
- 가격 정책과 정식 출시 일정 등 구체적인 상용화 정보는 아직 공개되지 않았다
이 리뷰가 유용했나요?
공유하기
관련 AI 리뷰
Slack Code 출시: Claude Code·Devin 등 AI 코딩 에이전트를 채널에 임베드
Slack이 AI 코딩 에이전트를 전용 채널에 임베드하는 Slack Code를 출시했다. Claude Code, Devin, Copilot 등을 대화·플랜·diff·라이브 프리뷰 탭으로 팀 전체가 실시간 조정한다.
Perplexity 인도 매출, Airtel 무료 혜택 종료 후에도 9% 증가
AI 검색 서비스 Perplexity의 인도 Airtel 무료 제휴가 종료됐다. 다운로드는 급감했지만 일평균 매출은 오히려 9% 증가해 유료 전환 신호로 해석된다.
Higgsfield 시리즈B 4억 달러 유치, 밸류에이션 54억 달러로 4배 급등
AI 영상·이미지 생성 플랫폼 Higgsfield가 DST Global 주도로 4억 달러 시리즈B를 유치했다. 밸류에이션은 54억 달러, ARR은 7억 달러에 달했다.
SpaceX, 600억 달러 Cursor 인수 공식 완료: 4월 옵션 실제 행사
SpaceX가 4월 체결한 600억 달러 Cursor 인수 옵션을 8월 14일 실제로 행사해 인수를 완료했다. 벤처 투자 기업 인수 사상 두 번째로 큰 규모로 평가된다.
