WEBSITE ĐANG PHÁT TRIỂN

Cloudflare buộc công ty AI phải trả tiền để crawl nội dung của nhà xuất bản

Từ ngày 15/9/2026, Cloudflare sẽ mặc định chặn các bot AI "dùng đa mục đích" (mixed-use) trên mọi trang web có quảng cáo, trừ khi công ty AI tách riêng bot tìm kiếm và bot huấn luyện/agent. Đây là bước tiếp theo trong chiến dịch "Pay Per Crawl" của Cloudflare, cho phép nhà xuất bản tính tiền công ty AI mỗi khi bot của họ lấy nội dung. Với website và báo chí Việt Nam đang bị AI bot crawl miễn phí mỗi ngày, đây là công cụ đầu tiên giúp đòi lại giá trị nội dung của mình, nhưng chỉ khi bạn dùng Cloudflare và biết bật đúng tính năng.

Cloudflare buộc công ty AI phải trả tiền để crawl nội dung của nhà xuất bản

Nội dung chính

1. Cloudflare nói gì

Cloudflare, công ty hạ tầng internet đứng sau hơn 20% lưu lượng web toàn cầu, vừa công bố thay đổi mặc định quan trọng: bắt đầu từ 15/9/2026, các bot "mixed-use", tức bot vừa phục vụ tìm kiếm, vừa phục vụ AI agent, vừa lấy dữ liệu huấn luyện mô hình, sẽ bị chặn mặc định trên mọi trang web có chạy quảng cáo. Thay đổi này áp dụng cho khách hàng mới, các trang mới của khách hàng hiện tại, và toàn bộ người dùng gói miễn phí.

Điểm quan trọng: bot tìm kiếm thuần túy, ví dụ bot Google Search dùng để index trang cho kết quả tìm kiếm, không bị ảnh hưởng. Cloudflare chỉ nhắm vào những bot "gộp chung nhiều việc", vừa giúp người dùng tìm kiếm, vừa âm thầm lấy nội dung huấn luyện AI hoặc phục vụ AI agent trả lời câu hỏi thay bạn đọc bài gốc.

CEO Matthew Prince của Cloudflare phát biểu thẳng: "phần lớn lưu lượng trên Internet hiện nay không phải do con người tạo ra." Dữ liệu Cloudflare công bố cho thấy hơn 50% lưu lượng bot AI là crawl lại những trang không có gì thay đổi, tức lãng phí tài nguyên server của nhà xuất bản mà không tạo giá trị mới cho ai.

2. Dịch ra tiếng người bình thường: điều này nghĩa là gì thực tế?

Trước đây, công ty AI có thể lập luận: "bot của chúng tôi giúp người dùng tìm thấy trang của bạn, nên chúng tôi được crawl miễn phí." Cloudflare không mua lập luận đó nữa. Nếu một bot vừa giúp tìm kiếm, vừa lấy dữ liệu về nuôi mô hình AI hoặc trả lời thay câu hỏi của người đọc, nó phải tách bạch rõ hai vai trò này, hoặc bị chặn.

Đây chính là logic đằng sau "Pay Per Crawl", chợ giao dịch Cloudflare ra mắt trước đó, cho phép nhà xuất bản đặt giá: công ty AI muốn crawl nội dung phải trả tiền qua Cloudflare, tương tự cách bạn trả tiền mua báo giấy thay vì photocopy lén. Giờ đây, mô hình đang tiến thêm một bước, từ "Pay Per Crawl" (trả tiền mỗi lần crawl) sang "Pay Per Use" (trả tiền theo giá trị nội dung tạo ra), nghĩa là nhà xuất bản có thể tính tiền không chỉ khi bot lấy trang, mà cả khi nội dung đó được dùng để tạo ra câu trả lời sinh lời cho công ty AI. Ceramic.ai và You.com là hai đối tác đầu tiên tham gia mô hình mới này.

So với trước đây, điểm thay đổi quan trọng nhất là: mặc định đã đảo ngược.

Trước 15/9/2026 Sau 15/9/2026
Mặc định Nhà xuất bản tự đi chặn bot AI nếu muốn Bot AI mixed-use bị chặn mặc định
Ai phải hành động Nhà xuất bản Công ty AI
Trả tiền Không bắt buộc Phải trả qua Pay Per Crawl nếu muốn crawl tiếp

3. Nghĩa vụ của bạn là gì, nếu bạn có website tại Việt Nam?

Câu hỏi nhiều chủ website và tòa soạn báo Việt Nam nên đặt ra ngay: nội dung của mình có đang bị AI bot lấy miễn phí để trả lời thay người đọc không?

Nếu website của bạn dùng Cloudflare (miễn phí hoặc trả phí), bạn không cần lo phải tự code gì phức tạp: thay đổi mặc định 15/9/2026 sẽ tự động áp dụng. Việc bạn cần làm là vào dashboard Cloudflare, kiểm tra mục quản lý bot AI, xác nhận danh sách bot nào đang được chặn, bot nào được phép, và nếu muốn, bật tính năng Pay Per Crawl để bắt đầu tính tiền công ty AI muốn lấy nội dung của mình.

Nếu website chưa dùng Cloudflare, đây là thời điểm hợp lý để xem xét, đặc biệt với các tòa soạn báo điện tử, blog cá nhân có traffic lớn, hoặc trang thương mại điện tử có nội dung mô tả sản phẩm chi tiết, những dạng nội dung mà AI agent rất thích lấy để trả lời câu hỏi mua sắm thay người dùng.

Điều này ảnh hưởng gì đến bạn?

Với báo chí và website Việt Nam, đây là tín hiệu quan trọng vì hai lý do. Thứ nhất, phần lớn báo điện tử Việt Nam sống bằng quảng cáo hiển thị, và quảng cáo chỉ có giá trị khi có người thật đọc bài, không phải khi bot AI lấy nội dung để trả lời câu hỏi thay trên ChatGPT hay Gemini rồi người đọc không bao giờ click vào trang gốc. Cloudflare đang tạo ra công cụ đầu tiên chặn đứng vòng lặp này ở quy mô lớn.

Thứ hai, khung "Pay Per Crawl" của Cloudflare là ứng viên hàng đầu để Việt Nam tham khảo khi xây quy định bản quyền nội dung số, nơi luật về việc AI dùng nội dung báo chí, blog để huấn luyện mô hình vẫn còn thiếu quy định cụ thể. Nghĩa vụ pháp lý hiện tại của công ty AI với nội dung Việt Nam chưa rõ ràng bằng thị trường Mỹ hay EU, nhưng công cụ kỹ thuật kiểu Cloudflare cho phép nhà xuất bản tự bảo vệ mình trước, không cần chờ luật.

Lời khuyên cụ thể: nếu bạn quản lý một trang tin tức, blog, hoặc website doanh nghiệp có nội dung gốc giá trị, hãy kiểm tra ngay hôm nay xem mình đang dùng Cloudflare hay dịch vụ tương đương nào, và bật tính năng quản lý bot AI. Đây không phải bước kỹ thuật phức tạp, chỉ là vài cú click trong dashboard, và là bước đầu tiên để nội dung của bạn không còn bị "ăn miễn phí" bởi các mô hình AI.

Số liệu & thống kê

  • Cloudflare xử lý hơn 20% lưu lượng web toàn cầu.
  • Thay đổi mặc định có hiệu lực từ 15/9/2026, áp dụng cho khách hàng mới, trang mới, và toàn bộ gói miễn phí.
  • Hơn 50% lưu lượng bot AI là crawl lại trang không có nội dung mới.
  • Ceramic.ai và You.com là hai đối tác đầu tiên của mô hình "Pay Per Use".

Sources

# Title URL Ghi chú
1 Cloudflare's new policy pushes AI companies to pay for publishers' content https://techcrunch.com/2026/07/01/cloudflares-new-policy-pushes-ai-companies-to-pay-for-publishers-content/ TechCrunch, 1/7/2026

Bài viết liên quan

Xem thêm
Tin tức AI

Xiaomi ra mắt MiMo Code mã nguồn mở, vượt Claude Code ở nhiệm vụ siêu dài

Hãy nói thẳng: Xiaomi vừa tung ra MiMo Code, một trợ lý AI viết code chạy trong terminal (dòng lệnh), mã nguồn mở, miễn phí dùng model đi kèm trong thời gian giới hạn, và tuyên bố vượt Claude Code của Anthropic ở các nhiệm vụ dài hơn 200 bước thao tác. Điểm hay nhất không phải model AI bên trong, mà là cách nó "ghi nhớ" xuyên suốt phiên làm việc dài, thứ mà hầu hết AI coding assistant hiện nay vẫn làm rất tệ. Nhưng số liệu là do Xiaomi tự công bố, chưa ai kiểm chứng độc lập, nên đọc kỹ trước khi tin.

Tin tức AI

Wikipedia đình công vì AI: hàng trăm biên tập viên đe dọa ngừng sửa bài

Hàng trăm biên tập viên Wikipedia – những người tình nguyện duy trì chất lượng nội dung – đang đe dọa đình công sau khi Wikimedia Foundation sa thải toàn bộ nhóm Community Tech vào tháng 5 năm 2026. Đây là nhóm kỹ sư xây dựng công cụ kiểm duyệt và chống phá hoại mà biên tập viên dựa vào hàng ngày. Nghiêm trọng hơn: Wikipedia là nguồn dữ liệu training chính cho hầu hết mô hình AI lớn. Nếu chất lượng Wikipedia suy giảm, chất lượng AI cũng sẽ bị ảnh hưởng theo.