AI-agents ngày càng đảm nhận nhiều công việc thường ngày: thu thập giá cả của đối thủ, quản lý tài khoản trên mạng xã hội, thử nghiệm các chiến dịch quảng cáo. Nhưng bất kỳ hình thức tự động hóa nào cũng có một khoản chi phí ẩn — lưu lượng proxy. Chúng tôi đã thực hiện ba phép đo trên các nhiệm vụ điển hình và xác định được số gigabyte mà AI-agent "tiêu tốn" trong một giờ và một tháng làm việc, để bạn có thể tính toán chính xác ngân sách cho proxy và không phải trả quá nhiều.
Tại sao việc đo lưu lượng của AI-agent lại quan trọng
Hầu hết các proxy dân cư và di động được bán theo khối lượng lưu lượng, chứ không phải theo số lượng IP hoặc thời gian. Điều này hoàn toàn khác biệt so với các gói dịch vụ từ trung tâm dữ liệu, nơi thường có mức giá cố định cho mỗi cổng. Khi nói đến công việc thủ công — một người lướt Instagram hoặc kiểm tra giá trên Ozon — mức tiêu thụ lưu lượng là dễ đoán và không lớn. Nhưng khi nhiệm vụ được giao cho AI-agent, bức tranh hoàn toàn thay đổi.
AI-agent làm việc không có khoảng nghỉ, thường mở các trang hoàn toàn (với tất cả hình ảnh, script, tracker), có thể đồng thời quản lý hàng chục phiên và tạo ra nhiều yêu cầu hơn gấp nhiều lần so với con người trong cùng một khoảng thời gian. Nếu không có phép đo trước, rất dễ rơi vào tình huống mà gói lưu lượng đã mua hết chỉ sau vài ngày thay vì một tháng, và tự động hóa bị dừng lại do thiếu giới hạn.
Chúng tôi đã quyết định lấp đầy khoảng trống này và thực hiện các phép đo trên ba kịch bản thường gặp nhất đối với các nhà tiếp thị, chuyên gia SMM và người bán trên các sàn thương mại điện tử, những người sử dụng AI-agents để tự động hóa thông qua các trình duyệt chống phát hiện như Dolphin Anty, AdsPower và Octo Browser.
Phương pháp đo lường: những gì và cách tính toán
Để đảm bảo tính chính xác của thí nghiệm, chúng tôi đã sử dụng một cấu hình giống nhau: trình duyệt chống phát hiện AdsPower với các proxy dân cư được kết nối, bộ đếm lưu lượng ở cấp độ máy chủ proxy và ghi lại các yêu cầu thông qua công cụ giám sát mạng tích hợp trong trình duyệt. AI-agent được triển khai dưới dạng một script dựa trên trình duyệt không giao diện với mô-đun LLM để đưa ra quyết định (tương tự như cấu hình Playwright + GPT-agent), được khởi động qua cùng một phiên proxy trong suốt quá trình thử nghiệm.
Mỗi kịch bản được chạy 3 lần vào các thời điểm khác nhau trong ngày để loại trừ sai số do tải nội dung động và trọng lượng khác nhau của các banner quảng cáo trên các trang web. Các con số cuối cùng là giá trị trung bình của ba lần chạy. Chúng tôi ghi lại: tổng khối lượng dữ liệu đã truyền (lưu lượng vào + lưu lượng ra), số lượng yêu cầu HTTP, thời gian thực hiện nhiệm vụ và khối lượng lưu lượng cho một "hành động" của agent (một lần xem sản phẩm, một bài đăng, một lần khởi động quảng cáo).
Một chi tiết quan trọng: chúng tôi không chặn việc tải hình ảnh và phương tiện, vì trong các nhiệm vụ thực tế, AI-agent thường cần phân tích nội dung hình ảnh — ảnh chụp màn hình các trang, hình ảnh sản phẩm, hình thu nhỏ video. Điều này làm tăng mức tiêu thụ lưu lượng so với việc phân tích văn bản qua API, nhưng phản ánh chính xác hơn điều kiện thực tế làm việc của hầu hết các agent hoạt động qua trình duyệt.
Kịch bản 1: thu thập giá trên Wildberries và Ozon
Nhiệm vụ của agent: duyệt qua 500 thẻ sản phẩm trong một danh mục nhất định, ghi lại giá cả, tình trạng và đánh giá, so sánh với giá của đối thủ và tạo báo cáo. Nhiệm vụ này điển hình cho các người bán theo dõi sự biến động giá trên các sàn thương mại điện tử theo thời gian thực.
Kết quả đo lường: việc xử lý 500 thẻ sản phẩm mất 42 phút và tiêu tốn 1,3 GB lưu lượng. Tính ra mỗi thẻ sản phẩm — khoảng 2,6 MB, điều này khá nhiều cho dữ liệu chỉ có văn bản. Nguyên nhân là Wildberries và Ozon tải đầy đủ bộ hình ảnh sản phẩm, đánh giá kèm hình ảnh và các khối quảng cáo trên mỗi trang, ngay cả khi agent chỉ cần giá.
Chúng tôi đã thử nghiệm tối ưu hóa: tắt việc tải hình ảnh và video ở cấp độ trình duyệt, chỉ để lại HTML và phản hồi JSON từ API của sàn thương mại điện tử. Mức tiêu thụ giảm xuống còn 340 KB cho mỗi thẻ — gần 8 lần. Nhưng trong khi đó, Wildberries thường hiển thị captcha trên các phiên "nhẹ" mà không có bộ tài nguyên tiêu chuẩn, điều này khiến agent phải thực hiện các yêu cầu lại qua IP mới, phần nào làm giảm lợi ích về lưu lượng.
Khi mở rộng cho toàn bộ danh mục gồm 10.000 sản phẩm và cập nhật dữ liệu hàng ngày, mức tiêu thụ lưu lượng khoảng 26 GB mỗi ngày mà không có tối ưu hóa và khoảng 3,4 GB với việc tắt media. Để thu thập dữ liệu với khối lượng lớn như vậy, proxy từ trung tâm dữ liệu là lựa chọn tốt hơn — chúng rẻ hơn khi tính theo gigabyte và cung cấp tốc độ cao hơn, điều này rất quan trọng khi có nhiều luồng song song.
Kịch bản 2: đăng bài tự động và làm nóng trên Instagram/TikTok
Nhiệm vụ của agent: giả lập hành vi của người dùng thực — lướt qua 15-20 bài đăng trong dòng thời gian, thích 5-7 bài trong số đó, để lại 2 bình luận, xem 3 Stories và đăng một bài với hình ảnh. Kịch bản này điển hình cho các công ty SMM, những người làm nóng các tài khoản mới của khách hàng trước khi bắt đầu quảng cáo hoặc thực hiện quảng bá tự nhiên.
Đo lường cho thấy: một chu trình hoàn chỉnh để làm nóng một tài khoản mất 8-11 phút và tiêu tốn 180-240 MB lưu lượng. Mức tiêu thụ chính là video trong Stories và Reels: ngay cả một video ngắn 15 giây cũng nặng trung bình 12-18 MB khi tự động phát ở chất lượng mặc định. Đăng một bài với hình ảnh qua bộ lọc thêm khoảng 15-20 MB cho việc tải lên và xác nhận.
Nếu công ty quản lý 30 tài khoản với việc làm nóng hàng ngày, tổng mức tiêu thụ sẽ khoảng 6-7 GB mỗi ngày, tức là khoảng 180-210 GB mỗi tháng cho toàn bộ nhóm tài khoản. Đây là một con số đáng kể mà cần phải tính vào ngân sách cho proxy trước — đặc biệt nếu mỗi tài khoản sử dụng một IP riêng biệt để tránh bị cấm chuỗi khi sử dụng nhiều tài khoản.
Đối với nhiệm vụ này, chúng tôi khuyên bạn nên sử dụng proxy di động — Instagram và TikTok có xu hướng ít "hung hăng" hơn đối với các địa chỉ IP di động của nhà mạng, vì phần lớn người dùng thực truy cập từ đó. Điều này làm giảm tần suất kiểm tra bổ sung và captcha, cũng làm tăng mức tiêu thụ lưu lượng do các lần thử lại.
Kịch bản 3: thử nghiệm sáng tạo trong Facebook Ads
Nhiệm vụ của agent: truy cập vào 10 tài khoản quảng cáo trong Facebook Ads Manager, khởi động 3 quảng cáo với các sáng tạo khác nhau trong mỗi tài khoản, theo dõi trạng thái kiểm duyệt mỗi 20 phút trong 2 giờ và thu thập thống kê ban đầu về lượt hiển thị và nhấp chuột. Đây là một kịch bản điển hình cho các nhà tiếp thị, những người thử nghiệm hàng chục kết hợp cùng một lúc.
Ads Manager là một trong những giao diện "nặng" nhất trong số tất cả các giao diện đã thử nghiệm: chỉ riêng việc tải bảng điều khiển của một tài khoản với thống kê tiêu tốn 8-12 MB do có nhiều script JS, biểu đồ và tracker của Meta Pixel. Một chu trình hoàn chỉnh — vào 10 tài khoản, đăng 30 quảng cáo với hình ảnh, cộng thêm 6 chu trình kiểm tra trạng thái — tiêu tốn 890 MB lưu lượng trong 2 giờ làm việc liên tục.
Tính ra mỗi tháng khi làm việc hàng ngày với khối lượng tài khoản như vậy, mức tiêu thụ sẽ khoảng 26-27 GB. Nếu một công ty hoặc nhóm tiếp thị quản lý hơn 50 tài khoản quảng cáo thông qua trình duyệt chống phát hiện như Dolphin Anty hoặc Multilogin, tổng lưu lượng có thể dễ dàng đạt 100-150 GB mỗi tháng chỉ cho hoạt động giám sát và khởi động các chiến dịch.
Ở đây, độ ổn định và "sạch sẽ" của IP là rất quan trọng: Facebook thường xuyên cấm tài khoản khi có sự thay đổi địa chỉ đáng ngờ hoặc khi làm việc với các IP từ trung tâm dữ liệu, dễ dàng bị phát hiện là proxy. Giải pháp tối ưu là proxy dân cư với một IP ổn định cho mỗi tài khoản: chúng trông giống như các kết nối gia đình thông thường và giảm nguy cơ bị cấm khi AI-agent hoạt động.
Bảng tổng hợp mức tiêu thụ lưu lượng
Dưới đây là các con số tổng hợp cho cả ba kịch bản để tính toán nhanh khối lượng lưu lượng cần thiết khi lập kế hoạch làm việc của AI-agents.
| Kịch bản | Lưu lượng cho 1 hành động | Lưu lượng mỗi ngày (khối lượng điển hình) | Loại proxy được khuyến nghị |
|---|---|---|---|
| Thu thập dữ liệu Wildberries/Ozon (10.000 thẻ) | 2,6 MB / 340 KB không có media | 26 GB / 3,4 GB không có media | Trung tâm dữ liệu |
| Làm nóng/đăng bài tự động trên Instagram (30 tài khoản) | 180-240 MB cho mỗi chu trình | 6-7 GB | Di động |
| Facebook Ads (10 tài khoản, 30 quảng cáo) | 890 MB trong 2 giờ | 10-13 GB (với 2-3 chu trình) | Dân cư |
Cách giảm mức tiêu thụ lưu lượng của AI-agent
Các phép đo cho thấy rằng phần lớn lưu lượng bị tiêu tốn bởi hình ảnh, video và script theo dõi, chứ không phải bởi chính dữ liệu hữu ích mà agent cần. Dưới đây là những cách đã được kiểm chứng để giảm mức tiêu thụ mà không làm giảm chất lượng tự động hóa:
- Tắt việc tải media ở những nơi có thể. Đối với các nhiệm vụ thu thập dữ liệu giá cả và đặc điểm sản phẩm, hình ảnh là không cần thiết — tiết kiệm lên tới 80-85%.
- Sử dụng API của các sàn thương mại điện tử và mạng xã hội thay vì tải đầy đủ trang, nếu trình duyệt chống phát hiện và quy định của nền tảng cho phép — điều này làm giảm trọng lượng yêu cầu xuống nhiều lần.
- Giới hạn tần suất kiểm tra trạng thái. Trong kịch bản với Facebook Ads, kiểm tra mỗi 20 phút thay vì mỗi 5 phút giảm mức tiêu thụ lưu lượng cho việc giám sát gần 4 lần mà không làm mất tính cập nhật của dữ liệu.
- Cache các tài nguyên tĩnh của phiên — logo, biểu tượng giao diện, file CSS — để agent không phải tải lại chúng mỗi khi khởi động mới.
- Thiết lập chất lượng video trong Stories/Reels ở mức tối thiểu cho các nhiệm vụ tự động xem, nếu điều này không ảnh hưởng đến việc thực hiện nhiệm vụ chính của agent.
Sự kết hợp của những phương pháp này trong các thử nghiệm của chúng tôi đã giảm tổng mức tiêu thụ lưu lượng từ 40-60% tùy thuộc vào kịch bản, trong khi tốc độ thực hiện nhiệm vụ của agent thậm chí còn tăng lên một chút nhờ vào trọng lượng trang giảm.
Loại proxy nào nên chọn cho nhiệm vụ
Loại proxy ảnh hưởng trực tiếp không chỉ đến chi phí lưu lượng mà còn đến độ ổn định của AI-agent. Đối với việc thu thập dữ liệu hàng loạt từ các sàn thương mại điện tử, nơi không có kiểm tra nghiêm ngặt về "tính người" của IP, proxy từ trung tâm dữ liệu là lựa chọn tối ưu — chúng nhanh, rẻ hơn khi tính theo gigabyte và rất phù hợp cho khối lượng lớn các yêu cầu đồng nhất.
Đối với việc làm việc với mạng xã hội và các tài khoản quảng cáo, nơi các nền tảng tích cực chống lại tự động hóa và sử dụng nhiều tài khoản, ưu tiên là các IP dân cư và di động. Chúng trông giống như các kết nối của người dùng thông thường, điều này giảm tần suất captcha và cấm, từ đó gián tiếp tiết kiệm lưu lượng do số lần thử lại và xác thực lại ít hơn.
Lời khuyên thực tiễn: không mua một gói lưu lượng lớn duy nhất "cho tất cả" — hãy phân chia các nhiệm vụ theo loại proxy dựa trên bản chất của chúng. Điều này vừa rẻ hơn, vừa đáng tin cậy hơn cho việc hoạt động ổn định của AI-agent trong dài hạn.
Kết luận
Các phép đo của chúng tôi cho thấy rằng mức tiêu thụ lưu lượng của AI-agent phụ thuộc rất nhiều vào loại nhiệm vụ: thu thập dữ liệu từ các sàn thương mại điện tử mà không tối ưu hóa có thể tiêu tốn hàng chục gigabyte mỗi ngày, đăng bài tự động trên mạng xã hội — vài gigabyte cho toàn bộ nhóm tài khoản, và làm việc với các tài khoản quảng cáo Facebook Ads — lên đến 10-13 GB khi giám sát tích cực. Hiểu rõ những con số này giúp lập kế hoạch ngân sách cho proxy chính xác hơn và tránh tình huống khi lưu lượng hết trước thời gian.
Nếu AI-agent của bạn đang thu thập dữ liệu lớn từ Wildberries hoặc Ozon, hãy chú ý đến proxy từ trung tâm dữ liệu — chúng mang lại tỷ lệ tốt nhất giữa tốc độ và chi phí lưu lượng. Đối với việc làm nóng và tự động hóa trên Instagram và TikTok, proxy di động sẽ phù hợp hơn, trong khi để làm việc ổn định với các tài khoản quảng cáo và sử dụng nhiều tài khoản — proxy dân cư với IP cố định cho mỗi tài khoản là lựa chọn tốt nhất.