Hai nghìn tám trăm tỷ (2,8 nghìn tỷ). Sáu trăm bảy mươi tỷ USD. Năm triệu người dùng mỗi tuần. Một triệu token ngữ cảnh. Đó không phải bốn con số ngẫu nhiên, mà là bốn "chiều" của cùng một cuộc đua ngày 12/08/2026: ai có mô hình lớn nhất, ai đốt tiền hạ tầng nhiều nhất, ai có người dùng nhiều nhất, ai xử lý ngữ cảnh dài nhất. Bài roundup buổi chiều này đi qua sáu tin, mỗi tin mở bằng một con số - vì trong ngày hôm nay, con số chính là ngôi sao.
Nội dung chính
1. Kimi K3: 2,8 nghìn tỷ tham số, mã nguồn mở, chạy trên cloud lẫn local
Con số 2,8 nghìn tỷ (2,8 trillion) tham số nghe thì choáng váng - lớn gấp gần 100 lần so với Muse Glimmer 30 tỷ tham số mà Meta mở mã cùng ngày. Nhưng để đặt vào bối cảnh: đây là mô hình ngôn ngữ mã nguồn mở đầu tiên chạm ngưỡng 3 nghìn tỷ tham số, theo Moonshot AI (Bắc Kinh). Bài đăng trên VentureBeat và blog chính thức của Kimi xác nhận: trọng số đã được phát hành trên Hugging Face dưới giấy phép Kimi K3 License (cho phép chạy, tinh chỉnh, thương mại hóa với một số điều khoản).
Các thông số đáng chú ý:
- 2,8 nghìn tỷ tham số tổng, xây trên hai kiến trúc mới: Kimi Delta Attention (KDA) và Attention Residuals (AttnRes).
- Context 1 triệu token - đủ nhét vào một cuốn tiểu thuyết dài và yêu cầu mô hình tóm tắt mà không quên chi tiết.
- Vision đa phương tiện: hiểu văn bản, hình ảnh, video trong cùng một mô hình.
- Giá API được công bố ở mức "thấp hơn đáng kể" so với các model Mỹ cùng phân khúc.
Theo Moonshot, K3 còn có khả năng tự hoàn thành quy trình thiết kế chip trong 48 giờ bằng công cụ EDA mã nguồn mở - một ví dụ cụ thể cho thấy tác vụ dài hạn đang được giải quyết ít cần con người hơn.
2. Meta Muse Code và Muse Spark 1.2: cuộc chiến AI coding thêm một đối thủ
VentureBeat đưa tin Meta phát hành đồng thời hai sản phẩm vào ngày 5/08/2026, nhưng hôm nay chúng bắt đầu được cộng đồng dev đánh giá rộng rãi:
- Muse Code: một "agent" lập trình chạy trên terminal, điểm đặc biệt là hỗ trợ async background agents - tức là giao việc cho AI rồi đóng terminal, đi pha cà phê, quay lại đọc kết quả.
- Muse Spark 1.2: bản cập nhật của dòng Muse Spark, tối ưu riêng cho coding, có một tier "contributor" rẻ hơn 12 lần so với tier thông thường.
Đây là phát súng mới nhất vào cuộc chiến AI coding, nơi hiện có Cursor, Claude Code, GitHub Copilot, Cognition (Devin), và giờ là Meta. Sự khác biệt: Meta chọn terminal làm giao diện chính thay vì IDE trong cloud - phù hợp với developer thích quy trình local-first.
3. Perplexity hybrid local-cloud: AI quyết định theo thời gian thực việc nào xử lý ở đâu
Tại Computex 2026 (Đài Loan), Perplexity AI trình diễn một hệ thống gọi là "hybrid local-cloud inference orchestrator". Ý tưởng: khi bạn ra lệnh cho AI, hệ thống phân tích từng phần việc và quyết định ngay lúc đó việc nào chạy trên thiết bị của bạn (giữ riêng tư, tiết kiệm tiền cloud), việc nào gửi lên server (cần GPU mạnh, dữ liệu lớn). Quyết định này diễn ra mid-task, không phải lúc bạn gửi yêu cầu.
Tại sao đáng quan tâm? Vì đây là lần đầu tiên "nơi AI chạy" trở thành một tính năng sản phẩm, không còn là chi tiết kỹ thuật nội bộ. Theo nhận định của EarlyFinder, điều này xác nhận một xu hướng: chiến trường AI đang chuyển từ "ai có model giỏi nhất" sang "ai kiểm soát được chi phí inference tốt nhất".
4. 670 tỷ USD đầu tư hạ tầng AI: lớn hơn dự án Apollo
Theo The Verge, bốn ông lớn Meta, Microsoft, Amazon, Alphabet (Google) dự kiến chi tổng cộng 670 tỷ USD cho hạ tầng AI trong năm 2026. Tính theo tỷ lệ phần trăm GDP Mỹ, con số này lớn hơn cả dự án Apollo đưa người lên Mặt Trăng thập niên 1960.
Để đặt vào bối cảnh Việt Nam: 670 tỷ USD gấp khoảng 1,7 lần tổng GDP Việt Nam năm 2025 (khoảng 480 tỷ USD theo ước tính của IMF). Tức là bốn công ty Mỹ sẽ đổ vào AI năm nay một khoản tiền tương đương 170% GDP của một quốc gia 100 triệu dân.
Đây là lý do vì sao chip AI (Nvidia H200, Blackwell), data center, và lưới điện trở thành chủ đề nóng trong bầu cử Mỹ - quy mô đầu tư đã vượt qua phạm vi công nghệ thuần túy, trở thành câu chuyện địa chính trị.
5. Trung tâm dữ liệu AI và lưới điện Mỹ: cuộc khủng hoảng năng lượng đang hình thành
The Verge có một loạt bài theo dõi chuyên đề "AI data centers" cho thấy các cụm trung tâm dữ liệu AI đang tạo ra ba tác động lớn:
- Lưới điện: một số bang (Virginia, Texas) phải hoãn kết nối data center mới vì quá tải.
- Nước: hệ thống cooling tiêu thụ lượng nước khổng lồ, đụng độ với nhu cầu dân sinh.
- Cộng đồng: người dân sống quanh data center phản đối tiếng ồn, mất giá bất động sản, lo ngại sức khỏe.
Đây là "phí thực tế" của cuộc đua AI - không phải ai cũng nói tới khi đăng con số "670 tỷ USD đầu tư".
6. Ba con số phụ: Codex 5 triệu user, MXC sandbox, Glasswing 10K lỗ hổng
Tổng hợp từ EarlyFinder, ba số liệu phụ đáng để ý:
- OpenAI Codex: 5 triệu người dùng mỗi tuần. 20% trong số đó không phải lập trình viên (data analyst, sales, investment banking), và nhóm này đang tăng nhanh gấp 3 lần nhóm dev. Ý nghĩa: sản phẩm AI cho người đi làm văn phòng đang có đà tăng trưởng rất nhanh.
- Microsoft MXC (Model Execution Containment): sandbox cấp OS cho AI agent, có OpenAI và Nvidia cùng tham gia phát triển. Đây là dấu hiệu Microsoft đang "đóng gói an toàn agent" thành sản phẩm tiêu chuẩn.
- Anthropic Glasswing: đã tìm ra hơn 10.000 lỗ hổng nghiêm trọng trên hạ tầng phần mềm quan trọng, với 150 đối tác ở hơn 15 quốc gia. Con số 10K không phải marketing - nó là kết quả thực tế, đo được.
Điều này ảnh hưởng gì đến bạn?
Nếu bạn là dân văn phòng đang dùng AI: hôm nay là ngày tốt để test một công cụ mới. Kimi K3 mã nguồn mở có thể xuất hiện trên các nền tảng như Hugging Face trong vài tuần tới; Perplexity hybrid có thể giúp các tác vụ nhạy cảm (dữ liệu khách hàng, hồ sơ nội bộ) chạy local mà vẫn mượt. Con số 20% Codex user là non-dev cho thấy bạn không cần biết code để dùng AI chuyên sâu - đó là cơ hội nghề nghiệp thật sự.
Nếu bạn là SME Việt Nam: 670 tỷ USD đầu tư toàn cầu đồng nghĩa với giá chip GPU sẽ tiếp tục cao và cạnh tranh quyết liệt hơn. Các nhà cung cấp API Việt Nam sẽ phải tìm cách tối ưu chi phí inference (như Perplexity vừa làm), và đó là cơ hội cho doanh nghiệp Việt làm dịch vụ AI infrastructure.
Nếu bạn là lập trình viên: Meta Muse Code ra mắt có nghĩa bạn có thêm một công cụ AI coding nữa để thử. Tier "contributor" rẻ hơn 12 lần là dấu hiệu cuộc chiến giá đang nóng - nếu bạn đang trả tiền cho Cursor hoặc Copilot, hãy chuẩn bị sẵn sàng chuyển.
Nếu bạn là người quan tâm năng lượng và đô thị: cuộc khủng hoảng data center ở Mỹ là bài học cho Việt Nam. Trước khi các dự án data center lớn đặt tại Bình Dương, Hà Nội hay TP.HCM, hãy đặt câu hỏi về lưới điện, nước, và cộng đồng xung quanh trước.
Số liệu & thống kê
| # | Con số | Ý nghĩa | Nguồn |
|---|---|---|---|
| 1 | 2,8 nghìn tỷ tham số | Mô hình mã nguồn mở lớn nhất từ trước đến nay | Moonshot AI / Kimi blog |
| 2 | 1 triệu token | Độ dài ngữ cảnh của Kimi K3, đủ nhét một cuốn sách dài | Moonshot AI |
| 3 | 670 tỷ USD | Đầu tư hạ tầng AI 2026 của Big Tech Mỹ, lớn hơn dự án Apollo | The Verge |
| 4 | 12 lần rẻ hơn | Tier "contributor" của Muse Code so với tier chính | VentureBeat |
| 5 | 5 triệu user/tuần | Lượng dùng Codex của OpenAI | OpenAI qua EarlyFinder |
| 6 | 20% / 3x | Tỷ lệ Codex user không phải dev, tốc độ tăng so với dev | OpenAI qua EarlyFinder |
| 7 | 150 đối tác | Số lượng tổ chức dùng Claude Mythos cho Glasswing | Anthropic |
| 8 | 10.000+ lỗ hổng | Số lỗ hổng nghiêm trọng được phát hiện qua Glasswing | Anthropic |
Sources
| # | Title | URL | Ghi chú |
|---|---|---|---|
| 1 | China's Moonshot AI releases Kimi K3, the largest open source model ever | https://venturebeat.com/technology/chinas-moonshot-ai-releases-kimi-k3-the-largest-open-source-model-ever-rivaling-top-u-s-systems | Bài gốc VentureBeat |
| 2 | Kimi K3: 2,8T Open Model for Coding & Knowledge Work | https://www.kimi.com/ai-models/kimi-k3 | Trang sản phẩm chính thức |
| 3 | Meta enters the AI coding wars with Muse Spark 1.2 and Muse Code | https://venturebeat.com/orchestration/meta-enters-the-ai-coding-wars-with-muse-spark-1-2-and-muse-code-with-persistent-async-background-agents | Bài gốc VentureBeat |
| 4 | Perplexity AI unveils hybrid local-cloud inference system at Computex 2026 | https://venturebeat.com/technology/perplexity-ai-unveils-hybrid-local-cloud-inference-system-at-computex-2026 | Bài gốc VentureBeat |
| 5 | 2026 AI investments will cost more than the Moon landing | https://www.theverge.com/ai-artificial-intelligence/875630/2026-ai-investments-will-cost-more-than-the-moon-landing | Bài gốc The Verge |
| 6 | All the latest updates on AI data centers | https://www.theverge.com/ai-artificial-intelligence/902546/data-centers-ai-energy-power-grids-controversy | Chuyên đề The Verge |
| 7 | AI Startup News 2026: The Runtime War Moves On-Device | https://earlyfinder.co/blog/ai-startup-news-2026-the-runtime-war-moves-on-device-1780466501556 | Phân tích góc startup/earlyfinder |