퍼플렉시티, 윈도우 RTX PC용 로컬 AI 에이전트 출시
퍼플렉시티의 포터블 컴퓨터는 24GB 이상 VRAM을 가진 RTX GPU에서 AI 에이전트를 로컬로 실행하며, 오늘 윈도우 버전이 출시되고 오피스, 슬랙, 깃허브 커넥터가 내장되어 있다.
퍼플렉시티가 자사 AI 에이전트의 로컬 버전인 "포터블 컴퓨터"를 공개했다. 클라우드 서버를 거치지 않고 사용자 자신의 기기에서 직접 다단계 작업을 계획하고 실행하는 방식으로, 추론과 실행 루프 전체가 기기 안에서 돌아가기 때문에 민감한 파일이나 인증 정보, 비즈니스 데이터가 기기 밖으로 나갈 필요가 없다. 윈도우 지원은 발표 당일인 오늘부터 시작되며, 기존에 지원하던 리눅스 기반 RTX PC와 엔비디아 DGX 스파크 시스템에 이어지는 형태다. DGX 스테이션 지원도 조만간 제공될 예정이라고 한다. 이 시스템을 구동하려면 24GB 이상의 VRAM을 탑재한 엔비디아 지포스 RTX 또는 RTX 프로 GPU가 필요한데, 이 기준 자체가 돌릴 수 있는 하드웨어와 돌릴 수 없는 하드웨어를 가르는 분명한 경계선이 된다.
내부적으로 포터블 컴퓨터는 큐원 3.8 27B처럼 로컬 환경에 맞게 최적화된 모델을 사용해서, 사용자가 직접 로컬 모델을 복잡하게 설정할 필요를 없앴다. 마이크로소프트 오피스, 구글 워크스페이스, 슬랙, 깃허브와 연동되는 커넥터가 내장되어 있고, 브라우저와 "스페이스"라는 이름의 샌드박스 환경도 함께 제공된다. 퍼플렉시티가 예로 든 활용 사례로는 깃허브 풀 리퀘스트 관리, 세무 문서를 넘나드는 재무 분석, 스타트업을 위한 사용자 퍼널 분석 등이 있으며, 이 모든 작업이 파일을 외부 서비스에 업로드하지 않고 전부 기기 안에서 처리된다. 발표 시점에 가격 정보는 공개되지 않았다.
24GB VRAM이라는 현실적인 문턱
24GB 이상의 VRAM 요구 사항은 사소한 조건이 아니라 명확한 걸러내기 기준이다. 대부분의 보급형 소비자용 GPU를 대상에서 제외시키고, 프로슈머급이나 워크스테이션급 하드웨어, 또는 DGX 스파크 같은 전용 시스템을 사실상 전제로 삼는다. 이는 의도된 절충이다. 제대로 된 에이전트 루프에 27B급 모델, 게다가 브라우저와 샌드박스까지 동시에 돌리려면 실질적인 메모리 여유가 반드시 필요하기 때문이다. 그 결과 "로컬 AI 에이전트"라는 표현은 누구나 갖다 붙일 수 있는 마케팅 문구에서 벗어나, 실제 사양표 그 자체가 된다. VRAM이 충분한지 여부가 곧바로 사용 가능 여부를 결정짓는다. 이는 "제대로 된" 온디바이스 에이전트의 기준이 되는 현실적인 하드웨어 하한선을 만들며, 프라이버시 이점은 원하면서도 매번 클라우드 API 비용을 내고 싶지 않은 애호가와 소규모 기업들 사이에서 GPU 교체 수요를 이끌어낼 가능성이 크다.
로컬 우선, 필요할 때만 클라우드라는 실용적인 절충안
기본적으로는 로컬에서 동작하되 사용자가 명시적으로 허용할 때만 클라우드 규모의 추론으로 넘어가는 이 하이브리드 방식은, 각각 한계가 뚜렷한 두 극단 사이의 실용적인 절충안이다. 순수 클라우드형 에이전트는 강력하지만 모든 문서를 기기 밖으로 보내야 하고, 순수 로컬형 에이전트는 프라이버시는 지키지만 가장 어려운 작업에서는 성능의 한계에 부딪힌다. 클라우드로의 확장을 사용자가 직접 선택하는 옵트인 방식으로 설계함으로써, 일상적인 문서 분석과 워크플로 자동화, 데이터 추출 작업은 전부 기기 안에서 끝내고, 정말로 필요한 순간에만 더 강력한 클라우드 모델을 불러올 수 있다. 대부분의 작업이 애초에 기기를 벗어나지 않기 때문에 클라우드 서비스 크레딧이나 건당 API 비용에 대한 의존도도 함께 줄어든다.
기업 데이터 거주 요건과 프라이버시에 민감한 업무에 갖는 의미
법률, 세무, 금융 분야의 업무에서는 규정 준수를 이유로 문서가 특정 관할 구역이나 회사 자체 인프라를 벗어날 수 없는 경우가 많은데, 로컬 우선 에이전트는 바로 이 지점에서 가능성의 범위를 넓힌다. 퍼플렉시티가 언급한 "세무 문서를 넘나드는 재무 분석" 사례가 그 직접적인 예시다. 민감한 신고 서류를 읽고 대조하고 요약하는 에이전트가 데이터를 어디로도 전송하지 않고 동작할 수 있다면, 아무리 데이터 처리 원칙을 강조하는 클라우드 전용 도구와 비교해도 위험 구조 자체가 달라진다. 깃허브 풀 리퀘스트 관리나 스타트업의 사용자 퍼널 분석에도 같은 논리가 적용되는데, 이런 작업은 고유 코드나 내부 지표를 다루기 때문에 기본값으로 제3자 서버에 보내고 싶어하지 않는 팀이 많을 수밖에 없다.
소비자·프로슈머 GPU 위 로컬 에이전트 경쟁 구도
전용 클라우드 구독을 요구하는 대신 소비자용과 프로슈머용 GPU 위에서 완전한 에이전트 스택을 돌리기로 한 선택은, 온디바이스 추론이 이미 실용성의 문턱을 넘었다고 판단하는 소수지만 늘어나고 있는 업체 무리에 퍼플렉시티를 합류시킨다. 24GB 이상 VRAM을 갖춘 RTX 또는 RTX 프로 GPU, 혹은 엔비디아 DGX 스파크와 DGX 스테이션 하드웨어를 요구한다는 것은, GPU를 언제든 바꿀 수 있는 범용 상품으로 취급하지 않고 이 제품을 엔비디아의 하드웨어 로드맵에 단단히 묶는다는 뜻이기도 하다. 같은 로컬 에이전트 시장에 뛰어드는 업체가 늘어날수록, 진짜 경쟁은 모델 품질만이 아니라 로컬과 클라우드 사이 전환을 얼마나 매끄럽게 처리하는지, 그리고 성능을 해치지 않으면서 VRAM 하한선을 얼마나 낮출 수 있는지를 중심으로 벌어질 가능성이 높다. 가격이 아직 공개되지 않은 이번 발표가 그 답을 내놓지는 않았지만, 로컬 실행을 예외가 아니라 기본값으로 삼는 에이전트형 AI를 향한 더 구체적인 한 걸음인 것만은 분명하다.
Sources
FAQ
퍼플렉시티의 포터블 컴퓨터란 무엇인가?
클라우드 서버가 아니라 사용자 자신의 기기에서 직접 다단계 작업을 계획하고 실행하는 퍼플렉시티 AI 에이전트의 로컬 버전으로, 데이터가 기기 안에 머문다.
구동하려면 어떤 하드웨어가 필요한가?
24GB 이상 VRAM을 갖춘 엔비디아 지포스 RTX 또는 RTX 프로 GPU, 혹은 DGX 스파크나 리눅스 기반 RTX PC가 필요하며 윈도우 버전은 오늘 출시된다.
필요할 때 클라우드 AI도 쓸 수 있나?
그렇다. 사용자의 명시적 허락이 있으면 복잡한 작업을 클라우드 모델로 넘길 수 있어, 로컬 프라이버시와 클라우드 성능을 함께 얻을 수 있다.