Nội dung chính
1. Perplexity vừa demo gì tại Computex?
Tôi đã theo dõi khá nhiều sản phẩm AI được giới thiệu onstage năm nay. Hầu hết là demo có kiểm soát chặt, kết quả không phản ánh thực tế.
Demo của Perplexity tại Computex 2026 thuộc dạng thú vị hơn – không phải vì nó đã hoạt động hoàn hảo, mà vì ý tưởng đằng sau nó giải quyết một vấn đề thật.
CEO Aravind Srinivas demo onstage cùng Intel CEO Lip-Bu Tan, dùng agent "Coworker" của Perplexity để xử lý tài liệu deal nội bộ. Hệ thống hoạt động như sau: khi agent nhận task, nó không đơn giản gửi tất cả lên server. Thay vào đó, nó phân tích từng phần – thông tin tài chính nhạy cảm thì giữ local, phần phân tích nặng cần frontier model thì mới gửi cloud.
Điểm quan trọng nhất: quyết định chạy local hay cloud không phải do người dùng đưa ra, cũng không phải theo rule tĩnh. Hệ thống tự quyết định mid-task, theo từng subtask.
"Chưa có sản phẩm nào làm được điều này trước đây," phát ngôn viên Perplexity nói với VentureBeat.
Tôi thấy tuyên bố đó đúng về mặt kỹ thuật. Nhiều tool đã cho phép chạy AI local. Nhưng routing tự động từng task theo độ nhạy cảm dữ liệu, mid-execution, là điều mới.
2. Tại sao ý tưởng này quan trọng (và tại sao nó khó)
Quảng cáo nói: AI tự động bảo vệ data nhạy cảm, không cần cấu hình.
Thực tế kỹ thuật phức tạp hơn nhiều. Để làm được điều này, hệ thống cần:
Phân loại độ nhạy cảm dữ liệu tự động và chính xác. Một file Excel có thể chứa số liệu công khai và thông tin nội bộ trong cùng sheet. Hệ thống cần hiểu ngữ nghĩa, không chỉ nhìn vào loại file.
Biết khả năng và độ trễ của hardware local. Nếu máy bạn không đủ mạnh để chạy model cần thiết, gửi lên cloud là đúng. Nếu máy đủ mạnh nhưng hệ thống vẫn gửi cloud vì sai phân loại – bạn vừa rò rỉ data nhạy cảm.
Theo dõi tiến trình task khi nó nhảy giữa hai môi trường. Một tác vụ đang xử lý có thể chuyển qua lại giữa máy local và cloud nhiều lần. Nếu hệ thống theo dõi sai trạng thái – ví dụ mất thông tin về bước đã làm xong ở đâu – lỗi xảy ra kiểu ngầm, không báo đỏ, rất khó phát hiện.
Perplexity nói hệ thống hỏi user trước khi gửi task nhạy cảm lên cloud – đây là quyết định đúng về UX. Nhưng điều đó cũng có nghĩa người dùng phải hiểu câu hỏi đủ để quyết định, không phải để hệ thống xử lý hoàn toàn tự động.
3. Đây là sản phẩm gì? Hành trình của Perplexity từ cloud đến hybrid
Để đánh giá hybrid inference, cần hiểu Perplexity đã đi đến đây như thế nào.
Perplexity Computer (đầu 2026): Agent đa mô hình chạy hoàn toàn trên cloud, điều phối 19 model khác nhau (Claude, Gemini, GPT, Grok,...) để hoàn thành task phức tạp. Đây là bước đầu: agent cloud mạnh.
Personal Computer (ra mắt tại Ask 2026 developer conference): Mac app hybrid local-cloud. Agent có thể truy cập file system và ứng dụng Mac native, chạy local cho tác vụ nhẹ, dùng server cho tác vụ nặng.
Hybrid inference tại Computex (6/2026): Bước tiến tiếp theo – thay vì phân chia "local = file system, cloud = reasoning", hệ thống quyết định granular hơn theo từng subtask và độ nhạy cảm dữ liệu.
Đây là kiến trúc nhất quán: Perplexity đặt cược vào orchestration layer, không phải model. Ai kiểm soát được tầng điều phối – quyết định model nào chạy ở đâu – người đó nắm lợi thế khi model ngày càng commodity hóa.
4. Phần cứng yêu cầu: không phải máy nào cũng làm được
Demo Computex chạy trên Intel Core Ultra Series 3 – dòng chip client AI thế hệ mới nhất của Intel. Nvidia cũng vừa ra mắt RTX Spark, chip Arm-based với 128GB LPDDR5X RAM và 300 GB/s băng thông – đủ để chạy model 120 tỷ tham số local.
Perplexity nói hệ thống sẽ chip-agnostic – tức là không bị ràng buộc vào chip của một hãng cụ thể, hoạt động được trên Intel, Nvidia, hay bất kỳ AI chip nào khác. Nhưng để hybrid inference hoạt động tốt, bạn cần phần cứng AI PC thế hệ mới. Máy tính hiện tại của đại đa số người dùng không đủ.
Tôi thích nhất: ý tưởng routing theo độ nhạy cảm dữ liệu mid-execution – đây là lối tiếp cận đúng về mặt kiến trúc, không phải giải pháp vá víu.
Tôi không thích: chúng ta đang phân tích từ demo onstage, không phải sản phẩm thật. Mọi đánh giá dưới đây là "nếu sản phẩm thật khớp demo."
Sẽ tốt cho (nếu sản phẩm thật khớp demo): Doanh nghiệp cần xử lý dữ liệu nhạy cảm – tài chính, pháp lý, y tế – đang muốn dùng AI mà không rò rỉ data ra ngoài; power user có AI PC thế hệ mới; IT team của ngành regulated đang tìm giải pháp compliance.
Chưa phù hợp với: Người dùng phổ thông với máy thường; ai đang tìm giải pháp AI privacy có thể dùng ngay hôm nay (chưa có); doanh nghiệp muốn giải pháp ổn định trong 6 tháng tới.
Tiêu chí tôi sẽ test khi sản phẩm ra: (1) Có phân loại đúng file Excel chứa cả số liệu công khai lẫn nội bộ trong cùng sheet không? (2) Nếu local hardware không đủ mạnh, hệ thống có hỏi người dùng trước khi gửi cloud không, hay tự gửi? (3) Audit log có đủ granular để biết từng subtask chạy ở đâu không?
5. Định giá $20 tỷ và 9 vụ kiện bản quyền
Perplexity vừa hoàn thành vòng gọi vốn định giá 20 tỷ USD (tăng từ 18 tỷ USD chỉ 2 tháng trước). Đây là mức tăng trưởng ấn tượng cho startup 3 năm tuổi.
Nhưng bức tranh tài chính không hoàn toàn màu hồng. Tính đến 31/5/2026, có 9 tổ chức đang kiện Perplexity vì vi phạm bản quyền – bao gồm CNN (vụ kiện mới nhất, ngày 28/5, cáo buộc scrape hơn 17.000 bài viết, ảnh, video của CNN). Perplexity phản hồi nhất quán: "Bạn không thể có bản quyền với sự kiện."
Một số publisher đã chọn hợp tác thay vì kiện: ký thỏa thuận licensing và nhận phần trăm doanh thu khi content của họ được trích dẫn trong câu trả lời Perplexity. Tỷ lệ chia sẻ là double-digit nhưng không công bố cụ thể.
Với doanh nghiệp đang cân nhắc dùng Perplexity cho workload nhạy cảm – hybrid inference chính là sản phẩm hướng đến đối tượng đó – rủi ro pháp lý chưa giải quyết là điểm cần theo dõi.
Điều này ảnh hưởng gì đến bạn?
Người dùng Perplexity Pro hiện tại: Hybrid inference chưa có. Theo Perplexity, sẽ ra mắt "trong vài tuần tới." Tính đến thời điểm bài này đăng, hãy theo dõi thông báo chính thức từ app.
Doanh nghiệp Việt Nam quan tâm AI mà ngại rò rỉ data: Đây là sản phẩm đáng theo dõi nhất trong 2026 cho use case đó. Ngân hàng, công ty chứng khoán, hãng luật – những nơi cần dùng AI mạnh nhưng dữ liệu không thể ra khỏi tường lửa – hybrid inference đúng hướng. Đặc biệt với các tổ chức tài chính phải tuân thủ Nghị định 13/2023/NĐ-CP về bảo vệ dữ liệu cá nhân, đây là hướng giải quyết kỹ thuật cho bài toán chủ quyền dữ liệu. Nhưng hãy chờ đến khi có sản phẩm thật để test, không nên ra quyết định dựa trên demo onstage.
Nếu bạn đang mua AI PC mới: Intel Core Ultra Series 3 và Nvidia RTX Spark là hai nền tảng Perplexity đang optimize cho. Nếu hybrid inference (và các hệ thống tương tự từ Apple, Microsoft, Google) là use case bạn quan tâm, đây là điểm cần để ý khi chọn phần cứng.
Góc nhìn chiến lược: Hybrid inference không chỉ là sản phẩm Perplexity. Computex 2026 cho thấy rõ xu hướng toàn ngành: mọi công ty AI lớn đều đang xây local-cloud routing. Apple có Private Cloud Compute với AI local, Google có Gemini chạy trên Pixel, Microsoft có MXC. Perplexity là người đầu tiên demo dynamic task-level routing – nhưng sẽ không là người duy nhất. Đây không còn là câu hỏi "có nên dùng hybrid không" mà là "ai làm tốt nhất" – và đó chính là tiêu chí tôi sẽ thêm vào checklist review mọi AI agent platform từ nay.
Số liệu & thống kê
- Valuation: $20 tỷ USD (vòng mới nhất), tăng từ $18 tỷ 2 tháng trước
- Vụ kiện đang hoạt động: 9 tổ chức (tính đến 31/5/2026), mới nhất là CNN
- Model hỗ trợ trong Perplexity Computer: 19 model khác nhau (Claude, Gemini, GPT, Grok, v.v.)
- Chip demo tại Computex: Intel Core Ultra Series 3
- Chip cùng timeline: Nvidia RTX Spark – 128GB LPDDR5X RAM, 300 GB/s bandwidth, hỗ trợ model 120 tỷ tham số
Sources
| # | Title | URL | Ghi chú |
|---|---|---|---|
| 1 | Perplexity AI unveils hybrid local-cloud inference system at Computex 2026 | https://venturebeat.com/technology/perplexity-ai-unveils-hybrid-local-cloud-inference-system-at-computex-2026 | VentureBeat, full content, Computex 2026 |
| 2 | CNN sues Perplexity over alleged AI copyright theft | https://edition.cnn.com/2026/05/28/media/cnn-sues-perplexity-ai-copyright | CNN Business, vụ kiện bản quyền mới nhất 28/5/2026 |
| 3 | Nvidia unveils RTX Spark Superchip at Computex 2026 | https://www.tomshardware.com/laptops/nvidia-unveils-rtx-spark-superchip-at-computex-2026 | Tom's Hardware, thông số RTX Spark đã xác minh |