Ngày 13 tháng 7 năm 2026, Cloudflare đã bắt đầu triển khai cho tất cả khách hàng Precursor — một động cơ khách hàng đánh giá không phải là một yêu cầu riêng lẻ hay việc vượt qua captcha, mà là hành vi trong toàn bộ phiên. Câu nói của CTO Cloudflare, Dane Knecht, ngắn gọn và chính xác: «Thay vì chỉ kiểm tra một ID ở cổng vào, chúng tôi đang xem xét hành vi trong suốt toàn bộ chuyến thăm» — thay vì kiểm tra thẻ vào cửa, chúng tôi xem xét hành vi trong suốt chuyến thăm.
Đối với những người tự động hóa trình duyệt — scrapers, đa tài khoản, tự động hóa SMM, AI-agents — đây là sự thay đổi đơn vị đo lường rủi ro. Trước đây, đơn vị là yêu cầu: vượt qua thử thách, nhận được cf_clearance, làm việc. Bây giờ, đơn vị là phiên, và nó sống, tích lũy đánh giá và có thể "hỏng" bất cứ lúc nào sau khi bạn đã vượt qua kiểm tra.
Cloudflare đã khởi động điều gì
Precursor là một đoạn mã mà Cloudflare tích hợp vào các trang thông qua mạng của mình. Nó được kích hoạt bằng một công tắc trong bảng điều khiển (Bảo mật → Cài đặt → Precursor), không yêu cầu thay đổi mã trên trang web, hoạt động trên toàn bộ khu vực ngay lập tức; hành vi cụ thể được điều chỉnh thông qua Precursor Rules. Nó không được định vị như một sự thay thế cho Turnstile, mà là một bổ sung cho nó: Turnstile là một kiểm tra một lần, Precursor là liên tục.
Những gì đoạn mã thu thập, theo mô tả của chính Cloudflare:
- chuyển động của con trỏ — quỹ đạo, tốc độ, đặc điểm của các cung;
- nhịp độ cuộn;
- nhịp độ gõ phím — thời gian và nhịp điệu, nhưng không phải là các phím đã nhấn;
- hoạt động của bộ nhớ tạm;
- sự thay đổi tiêu điểm của các phần tử và khả năng nhìn thấy trang/nhãn.
Tiếp theo là điều thú vị. Cloudflare mô tả rõ ràng rằng họ tìm kiếm trong những dữ liệu này không phải là "dấu vân tay", mà là vật lý và sinh lý của con người: các cung chuyển động của chuột, bị giới hạn bởi chuyển động của cổ tay, thay vì các chuyển động tuyến tính của tự động hóa; độ trễ nhận thức đo được giữa sự xuất hiện của kích thích trên màn hình và phản ứng; những dao động vi mô của tay — run — như tiếng ồn tự nhiên trong quỹ đạo.
Lớp thứ hai — kiểm tra chéo về các mâu thuẫn nội bộ. Con trỏ di chuyển trong khi trang bị ẩn? Các sự kiện từ bàn phím đến, nhưng không có trường văn bản nào trong tiêu điểm? Mỗi tín hiệu riêng lẻ trông có vẻ bình thường, nhưng khi kết hợp lại không tạo thành một bức tranh liên kết của một con người sống — và điều này bị phát hiện dễ dàng hơn bất kỳ phân tích nào của một cú nhấp chuột riêng lẻ.
Điều thứ ba và khó chịu nhất đối với tự động hóa: đánh giá tích lũy theo phiên và không bị đặt lại khi tải lại trang. Chiêu thức cổ điển "nhận được khối — F5 / tab mới" không còn là một cách đặt lại trạng thái. Kết quả của việc kiểm tra liên tục cập nhật chính xác cf_clearance, và Cloudflare viết rõ rằng xác nhận clearance đã được cấp có thể giảm hoặc bị hủy ngay giữa phiên, cũng như gây ra thử thách bổ sung.
Hai chế độ — và tại sao điều này quan trọng để biết trước
- Minimize Friction (mặc định) — kiểm tra nền mà không có interstitials. Người dùng không thấy gì, nhưng đảm bảo "phiên hợp lệ" yếu hơn.
- Maximize Security (được Cloudflare khuyến nghị) — thử thách interstitial nhẹ, thiết lập phiên hợp lệ, với sự suy giảm có ý thức về UX.
Kết luận thực tiễn: hành vi bảo vệ trên một trang web cụ thể hiện nay phụ thuộc vào cài đặt mà bạn không thấy từ bên ngoài. Cùng một đoạn mã, cùng một proxy và cùng một trang web có thể hành xử khác nhau trước và sau khi chủ sở hữu chuyển đổi chế độ. Các kích hoạt được chủ sở hữu trang web thấy trong Bảo mật → Phân tích → Lưu lượng → Phân tích bot — trong cùng một hàng với phân phối bot score và các trận đấu WAF.
Quy mô: tại sao đây không phải là "một anti-bot khác"
Bối cảnh khiến tin tức này quan trọng hơn một bản phát hành thông thường. Cloudflare xử lý hơn 1 triệu tỷ yêu cầu mỗi ngày, Turnstile hoạt động gần 3 tỷ lần mỗi ngày. Theo ước tính của công ty, lưu lượng tự động lần đầu tiên vượt qua lưu lượng con người và chiếm khoảng 57% tất cả các yêu cầu web. Việc kích hoạt lớp hành vi bằng một công tắc trên nền tảng như vậy có nghĩa là tỷ lệ internet, nơi có phát hiện hành vi theo phiên, có thể tăng vọt — mà không cần bất kỳ cam kết nào từ phía các trang web.
Và mục tiêu được công bố — chính là điều mà ngày nay mọi người đang sử dụng: "tự động hóa tiên tiến, thực thi JavaScript, hoạt động trong môi trường trình duyệt thực và vượt qua các captcha riêng lẻ mà không gây nghi ngờ". Có nghĩa là Playwright/Puppeteer với các bản vá stealth, trình duyệt chống phát hiện và trình duyệt đại lý — chính xác là mục tiêu mà Precursor mô tả một cách rõ ràng.
Để công bằng mà nói: Cloudflare chưa công bố dữ liệu định lượng — không có độ chính xác, không có tỷ lệ phát hiện sai, không có overhead từ việc giám sát liên tục trong trình duyệt. Hiện tại, đây là những khả năng được công bố, chứ không phải là đo lường độc lập. Cũng không thấy làn sóng phàn nàn công khai về việc chặn sai hàng loạt trong hai tuần triển khai.
Điều này có nghĩa là gì trong thực tế
1. Chất lượng IP không còn là "điều kiện đủ" — nhưng vẫn cần thiết
Kết luận hấp dẫn "vì phát hiện hành vi, proxy không còn quan trọng" — là sai. Precursor hoạt động trên các lớp trước đó: danh tiếng IP, TLS/HTTP fingerprinting, bot score. IP từ trung tâm dữ liệu trong một subnet bị lộ nhận được bot score cao và chế độ thử thách nghiêm ngặt ngay cả trước khi đến phân tích chuột. Hành vi là một kỳ thi bổ sung, không phải là sự thay thế cho bộ lọc đầu vào: các proxy dân cư sạch hoặc proxy di động với ASN sống chỉ đơn giản cho cơ hội để đến kỳ thi thứ hai.
2. Phiên — đối tượng vệ sinh mới
Trước đây, lỗi điển hình thường được nói là "quá nhiều yêu cầu từ một IP". Bây giờ, nó được bổ sung bằng "quá nhiều hoạt động không giống con người trong một phiên". Từ đó, thực tiễn:
- Không tái sử dụng một ngữ cảnh trình duyệt cho hàng trăm nhiệm vụ. Một phiên dài là một chuỗi hành vi dài, nơi bất kỳ bất thường nào cũng có thời gian để tích lũy. Phiên ngắn hơn — ít tài liệu hơn để chấm điểm.
- Giữ cặp "phiên ↔ IP" ổn định. Thay đổi IP đầu ra giữa phiên — là một mâu thuẫn rõ ràng; đối với các kịch bản có đăng nhập, cần có sticky sessions với thời gian sống phù hợp với nhiệm vụ, chứ không phải là luân chuyển tích cực cho mỗi yêu cầu.
- Không trộn lẫn các hồ sơ. Một tài khoản — một bộ ổn định: hồ sơ trình duyệt, IP, múi giờ, ngôn ngữ, mẫu hành vi.
3. Hành vi tổng hợp sẽ phải trở nên trung thực hơn — hoặc không làm gì cả
Các mô phỏng "con người" ngây thơ (chuyển động tuyến tính đến trung tâm nút, khoảng dừng đều 100 ms, nhấp chuột ngay lập tức sau khi tải) dưới các kiểm tra chéo hoạt động chống lại bạn: chúng thêm tín hiệu, chứ không loại bỏ nó. Nếu kịch bản không yêu cầu bắt chước con người — thì đáng tin cậy hơn là không tạo ra hành vi nào cả, hơn là tạo ra hành vi kém. Chúng tôi đã phân tích sâu hơn về lớp này trong tài liệu về sinh trắc học hành vi và proxy.
4. API endpoints và khách hàng không phải trình duyệt — một câu chuyện riêng
Precursor yêu cầu thực thi JavaScript. Các khách hàng không có trình duyệt — curl, backend di động — và các yêu cầu XHR/fetch đến các endpoints bảo vệ phải mang theo thông tin xác thực phiên một cách chính xác, tức là cf_clearance. Thực tế có nghĩa là: trước tiên trình duyệt thiết lập một phiên hợp lệ, và sau đó các yêu cầu "nhanh" đi kèm với cookie của nó và trong cùng một ngữ cảnh mạng (cùng một IP, hồ sơ TLS đã đồng ý). Sự khác biệt giữa phiên trình duyệt và khách hàng HTTP — là mâu thuẫn nội bộ mà họ tìm kiếm.
5. Điểm thu thập dữ liệu đang dịch chuyển
Nơi nào trang web kích hoạt Maximize Security, việc thu thập không đầu sẽ trở nên đắt đỏ hơn đáng kể. Phản ứng hợp lý — không phải là leo thang "mô phỏng thông minh" bằng mọi giá, mà là xem xét lại nguồn: API chính thức của nền tảng, feed đối tác, endpoints di động, tập dữ liệu công khai. Đường đi hoàn toàn trình duyệt có ý nghĩa để giữ lại ở nơi mà dữ liệu không thể lấy được theo cách khác.
Điều này đang đi đâu
Precursor hợp lý được tích hợp vào dòng Cloudflare trong năm qua: chặn các crawler AI theo mặc định, AI Crawl Control với các quy tắc chi tiết, Pay Per Crawl như một nỗ lực để làm cho việc truy cập vào nội dung trở thành có phí, và từ ngày 15 tháng 9 năm 2026 — chặn các crawler AI sử dụng hỗn hợp trên các trang có quảng cáo theo mặc định. Hướng đi chung: trang web muốn biết không phải "bạn có phải là con người vào thời điểm vào cửa hay không", mà là "bạn là ai trong suốt chuyến thăm và tại sao bạn đến".
Đối với thị trường tự động hóa, điều này có nghĩa là một sự dịch chuyển chậm nhưng một chiều: chi phí của một phiên "giống con người" đang tăng lên, chi phí của một yêu cầu không còn là chỉ số chính. Những người chiến thắng là những người thu thập ít hơn, nhưng chính xác hơn: các phiên cẩn thận, IP sạch cho nhiệm vụ, các dấu vân tay đồng nhất — và đánh giá tỉnh táo về những dữ liệu nào thực sự xứng đáng với con đường trình duyệt.
Tóm tắt
- Ngày 13 tháng 7 năm 2026, Cloudflare triển khai Precursor — phát hiện hành vi theo phiên, được kích hoạt bằng một công tắc mà không cần thay đổi mã trên phía trang web.
- Tín hiệu: con trỏ, cuộn, nhịp độ gõ (không có nội dung), bộ nhớ tạm, tiêu điểm và khả năng nhìn thấy; cộng với các kiểm tra chéo về mâu thuẫn.
- Đánh giá tích lũy theo phiên; tải lại trang không đặt lại chữ ký, clearance có thể bị hủy giữa chuyến thăm.
- Proxy không "bị hủy bỏ": lớp IP vẫn là bộ lọc đầu vào, hành vi là kỳ thi thứ hai.
- Cloudflare vẫn chưa công bố dữ liệu định lượng về độ chính xác và tỷ lệ phát hiện sai — còn quá sớm để đưa ra kết luận về độ nghiêm ngặt thực sự.
