WEBSITE ĐANG PHÁT TRIỂN

#ai-local

Perplexity hybrid inference: ý tưởng hay – nhưng thực sự hoạt động không?

Tại Computex 2026, Perplexity demo hệ thống hybrid inference – AI tự quyết định từng subtask chạy local trên máy hay gửi lên cloud, dựa theo độ nhạy cảm của dữ liệu. Ý tưởng kỹ thuật thú vị và chưa ai demo được theo cách này. Nhưng sản phẩm chưa ra mắt, thiết bị yêu cầu cao, và công ty đang đối mặt với 9 vụ kiện bản quyền. Đáng theo dõi, chưa đáng hype.

Google Gemma 4: model open source mạnh nhất, giấy phép Apache 2.0 – chạy được trên laptop 16GB

Google DeepMind vừa phát hành Gemma 4 – gia đình model AI open source mới nhất – dưới giấy phép Apache 2.0 (giống như Mistral và Qwen, không còn ràng buộc custom như trước). Gemma 4 có 5 kích thước, từ model siêu nhỏ chạy trên điện thoại đến model 31B cho workstation. Điểm đáng chú ý: model 12B "Unified" chạy hoàn toàn local trên laptop 16GB RAM, xử lý được ảnh, âm thanh, video, và có context window 256K token.