DEV Community

BeanBean
BeanBean

Posted on Originally published at nextfuture.io.vn

Nvidia PAIR: gộp PC và laptop trong nhà để chạy AI local

Originally published on NextFuture

Nvidia vừa mở beta Personal AI Router (PAIR), tool miễn phí gộp các máy trong cùng mạng nhà bạn để chạy inference local với Ollama và LM Studio.

Tên gọi dễ gây nhầm, nên nói rõ trước: PAIR không phải router phần cứng. Theo The Verge, đây là software mã nguồn mở do Nvidia phát triển, làm nhiệm vụ discover các PC tương thích trong mạng, kết nối chúng lại và chuẩn bị cho việc xử lý agentic workflow.

Máy nào chạy được

Phần lớn thiết bị tương thích là GPU GeForce: PAIR chạy với card RTX 20-series trở lên, RTX Pro GPU và hệ thống DGX Spark. Đáng chú ý cho anh em dùng máy Apple: chip M4 trở lên cũng hoạt động. Beta có sẵn từ hôm nay cho Windows, Linux và macOS.

Cách nó chia việc

Điểm quan trọng nhất về mặt vận hành: PAIR chỉ dùng máy khi máy đang idle, để không giành tài nguyên với việc khác. Cụm máy rời rạc này chạy song song để xử lý nhiều request, điều mà bài gốc đánh giá là hữu ích cho agentic workflow — loại workflow băm task lớn thành nhiều job nhỏ.

Nvidia nói PAIR có thể tự điều chỉnh khi thiết bị vào hoặc rời mạng, kể cả khi ai đó bắt đầu chơi game trên desktop. Về bảo mật, hãng cho biết các thiết bị pair với nhau qua mã sáu số, sau đó kênh truyền được bảo vệ bằng mTLS để tạo đường liên lạc mã hoá tin cậy hai chiều.

Con số 165 TFLOPs nên đọc thế nào

Trong buổi briefing, product manager Nvidia Seth Schneider vẽ ra một gia đình nhiều máy mạnh: bố có RTX Spark laptop lẫn DGX Spark desktop, mẹ có laptop RTX 5090, con gái có desktop gaming, con trai có MacBook Pro. Với trường hợp mà chính bài gốc gọi là cực đoan này, Schneider ước tính căn nhà đó có khoảng 165 teraflops compute chưa dùng tới, và mô tả đó là "kho token miễn phí đang nằm không trong các gia đình" — kể cả khi đã tính tiền điện ở một hộ Mỹ trung bình.

Đó là con số của hãng cho một kịch bản không giống nhà ai. Bản thân Schneider khi được hỏi setup thực tế là gì đã trả lời sát hơn: Nvidia hình dung phần lớn người dùng PAIR sẽ có kiểu một laptop MacBook hoặc Windows cộng một PC gaming.

Kèm theo: 3 app agent bớt bước cài

Cùng dịp này, Nvidia công bố ba app AI agent — Perplexity Portable Computer, Hermes Agent và OpenClaw — sẽ có luồng cài local đơn giản hoá với GPU Nvidia trên Windows, mục tiêu là chạy được agent local trong vài cú click và giảm bớt cấu hình thủ công ban đầu.

Đáng thử hay chưa

Phân tích thêm, không phải số liệu từ nguồn: nếu bạn đang có đúng combo laptop + PC gaming và đã chạy Ollama, PAIR là thứ đáng cài thử ngay ở mức beta, vì nó không đòi mua thêm gì. Ngược lại, đừng kỳ vọng nó biến hai máy tầm trung thành một server inference.

Ba thứ nên tự đo trước khi tin vào ý tưởng "token miễn phí": thời gian máy thật sự idle trong ngày làm việc của bạn, độ trễ khi request phải đi qua Wi-Fi thay vì LAN có dây, và hoá đơn điện theo giá bậc thang ở Việt Nam — cả ba đều không có trong công bố của Nvidia. Bài gốc cũng không đưa bất kỳ số liệu throughput hay latency nào, nên hiện chưa có cơ sở để so PAIR với việc gọi API.


This article was originally published on NextFuture. Follow us for more fullstack & AI engineering content.

Top comments (0)