Theo dõi lưu lượng AI trong GA4

Hướng dẫn cấu hình GA4 để theo dõi lưu lượng từ trợ lý AI: nhóm kênh AI Assistants, quy tắc nhận diện referrer, UTM, báo cáo tùy chỉnh và các giới hạn phân bổ đóng góp.

Xuất bản lần đầu: 3 thg 7, 2026 · Cập nhật lần cuối: 22 thg 8, 2026 · Advanced
Ngôn ngữ

GA4 cung cấp hai lớp theo dõi lưu lượng AI: kênh AI Assistant tích hợp sẵn, được thêm vào Default Channel Group ngày 13 tháng 5 năm 2026, và nhóm kênh tùy chỉnh dùng quy tắc Source matches regex. Thứ tự kênh rất quan trọng: AI phải nằm trên Referral, nếu không phiên từ chatgpt.com sẽ bị Referral nhận trước. Giá trị thực sự nằm trong Exploration đối chiếu Session source/medium, Landing page và Key events để xác định trang nhận lưu lượng và khả năng chuyển đổi. Hành vi UTM tùy nền tảng; ChatGPT ngày càng thêm utm_source=chatgpt.com, còn Perplexity, Gemini và Claude thường không. Kết hợp với Search Console cần phép nối URL thủ công. Vì 35–70% lượt truy cập AI không có referrer, mọi cấu hình ở đây chỉ đo mức sàn, không phải toàn bộ lưu lượng.

Các định nghĩa kênh tùy chỉnh được xét theo thứ tự, nên một quy tắc rộng ở phía trên có thể nhận phiên trước quy tắc AI cụ thể ở phía dưới. Evidence for this claim GA4 lets editors create custom channel groups from ordered rules, and a session is assigned to the first matching channel. Scope: GA4 custom channel groups; availability and limits depend on the property and product configuration. Confidence: high · Verified: Google Analytics: Custom channel groups Phân tích nguồn và phương tiện chỉ dựa trên thông tin thu nạp thực sự đến được GA4. Evidence for this claim GA4 exposes session source and session medium as acquisition dimensions for analyzing where sessions originated. Scope: Observable acquisition metadata; traffic without a usable referrer or campaign tag can be unattributed or classified as direct. Confidence: high · Verified: Google Analytics: Traffic-source dimensions

Tóm tắt — Có hai lớp: kênh AI Assistant tích hợp sẵn của GA4 (thuộc Default Channel Group, được thêm ngày 13 tháng 5 năm 2026; tự động, chỉ dựa vào referrer, không hồi tố và dùng danh sách nguồn được nhận diện hẹp hơn) và nhóm kênh tùy chỉnh do bạn xây dựng (phạm vi rộng hơn, áp dụng cho dữ liệu lịch sử và chiếm một trong hai vị trí nhóm tùy chỉnh của thuộc tính tiêu chuẩn). Thứ tự kênh mang tính quyết định: GA4 gán lưu lượng cho kênh khớp đầu tiên, nên AI phải nằm trên Referral. Giá trị thực sự đến từ Exploration dạng Free Form đối chiếu Nguồn/phương tiện của phiên × Trang đích × Sự kiện chính và một phân khúc AI có thể tái sử dụng. Hành vi UTM tùy nền tảng: ChatGPT ngày càng thường thêm utm_source=chatgpt.com, còn Perplexity, Gemini và Claude thường không. Kết hợp với Search Console là phép nối URL thủ công giữa lượt hiển thị GSC và phiên GA4 trên cùng trang đích, không phải báo cáo tích hợp sẵn. GA4 cũng không thể tách AI Overviews khỏi Organic Search. Mọi phép đo ở đây chỉ bao quát phần có referrer; 35–70% lượt truy cập không có referrer vẫn nằm trong Direct.

Hai lớp và phạm vi thực tế của từng lớp

Từ tháng 5 năm 2026, GA4 có hai cách riêng biệt để xem lưu lượng AI. Cần phân biệt chính xác chức năng của từng cách.

Lớp 1 — kênh AI Assistant tích hợp sẵn. Ngày 13 tháng 5 năm 2026, Google thêm kênh AI Assistant vào Default Channel Group của GA4. Google mô tả: “AI Assistants is the channel by which users arrive at your site from sources like ChatGPT, Gemini, Deepseek, Copilot, or Grok.” (bản dịch) «AI Assistants là kênh đưa người dùng đến website của bạn từ các nguồn như ChatGPT, Gemini, Deepseek, Copilot hoặc Grok.» Về cơ chế, khi referrer của một phiên khớp danh sách nguồn AI Assistant nội bộ của Google, GA4 gán phương tiện ai-assistant, chiến dịch (ai-assistant) và đưa phiên vào kênh này. Ba điểm cần nhớ: kênh tự động, chỉ dựa vào referrerkhông hồi tố. Danh sách nguồn được nhận diện cũng chưa được công bố đầy đủ, nên đây là một mục tiêu luôn thay đổi.

Lớp 2 — nhóm kênh tùy chỉnh do bạn xây dựng. Lớp này cho phép mở rộng phạm vi miền, phân khúc lại dữ liệu lịch sử mà kênh tích hợp bỏ qua và định nghĩa chính xác hành vi của kênh. Đổi lại, nó chiếm một trong 2 nhóm kênh tùy chỉnh của thuộc tính tiêu chuẩn (GA4 360 có 5; nhóm định nghĩa sẵn không tính vào giới hạn), và mỗi nhóm hỗ trợ tối đa 50 kênh. Phần lớn chuyên gia dùng cả hai: kênh tích hợp làm đường cơ sở không cần bảo trì, nhóm tùy chỉnh để có bức tranh đầy đủ hơn.

Cả hai lớp đều không thể tách lượt nhấp từ AI Overviews / AI Mode của Google khỏi lượt nhấp Organic Search thông thường. Định nghĩa kênh của Google xếp lượt nhấp từ tính năng AI vào Organic Search, còn referrer không khác một lượt nhấp Google bình thường. Vì vậy, không regex hay kênh tùy chỉnh nào tách được chúng. Đây là một giới hạn cần nêu rõ; lý do đằng sau nó là một chủ đề riêng.

Mức sàn của lưu lượng không xác định nguồn

Trước khi cấu hình, hãy đặt kỳ vọng đúng: các nghiên cứu ước tính 35% đến 70% lượt truy cập do AI thúc đẩy không có referrer và mặc nhiên rơi vào Direct (mẫu 446 405 lượt truy cập của Loamly cho kết quả cao nhất là 70,6%). Đây không phải lỗi nhận diện mà GA4 có thể sửa. Direct là nhóm dành cho trường hợp “no signal at all” (bản dịch) «hoàn toàn không có tín hiệu», nên lượt truy cập AI mất referrer được xếp giống URL nhập trực tiếp. Cấu hình trong bài không khôi phục được chúng. Cơ chế tạo lưu lượng này — chính sách referrer, noreferrer, trình duyệt trong ứng dụng và sao chép-dán — được giải thích trong bài phân tích phân bổ; ở đây chúng ta tập trung vào phần có thể đo lường.

Chọn đúng phạm vi: phiên hay người dùng đầu tiên

GA4 cung cấp dữ liệu nguồn AI ở hai phạm vi khác nhau. Nhầm lẫn giữa chúng sẽ âm thầm thay đổi câu hỏi mà báo cáo trả lời.

  • Session source / medium (phạm vi phiên) ghi nguồn và phương tiện của một lượt truy cập cụ thể. Đây là trường được dùng trong mọi bước cấu hình của bài: điều kiện regex cho Nguồn, Exploration ở Bước 4 và báo cáo trang đích ở Bước 5. Nó trả lời câu hỏi: «Lượt truy cập này có đến từ công cụ AI không?»
  • First user source / medium (phạm vi người dùng) ghi nguồn và phương tiện của lượt truy cập đầu tiên của người dùng rồi không thay đổi, dù họ quay lại qua kênh khác. Báo cáo User acquisition dùng phạm vi này; Traffic acquisition dùng phạm vi phiên.

Điều này quan trọng vì đưa kênh AI vào báo cáo User acquisition thay cho Traffic acquisition sẽ trả lời câu hỏi «Có bao nhiêu người dùng được thu nạp lần đầu qua AI?», không phải «Có bao nhiêu lượt truy cập trong kỳ đến từ AI?». Người dùng quay lại qua ChatGPT sau lần đầu đến từ tìm kiếm tự nhiên sẽ hiện là lưu lượng AI ở phạm vi phiên, nhưng là Organic Search ở phạm vi người dùng. Cả hai con số đều đúng; chúng trả lời hai câu hỏi khác nhau. Dùng số liệu của phạm vi này để diễn giải phạm vi kia sẽ gây hiểu lầm.

Mọi báo cáo trong bài — Exploration ở Bước 4, báo cáo trang đích ở Bước 5 và phép so sánh chuyển đổi ở Bước 6 — đều cố ý dùng phạm vi phiên, vì «AI đã gửi những lượt truy cập nào đến những trang nào?» là câu hỏi cấp phiên. Nếu cần câu trả lời cấp người dùng, hãy tạo Exploration thứ hai, gắn nhãn rõ ràng và dùng First user source / medium; đừng trộn hai phạm vi vào cùng bảng. Tài liệu của Google về các thuộc tính nguồn lưu lượng giải thích đầy đủ khác biệt phạm vi cho mọi thuộc tính thu nạp, không chỉ nguồn/phương tiện.

Bước 1 — kiểm tra kênh tích hợp đã hoạt động chưa

Trong Reports > Acquisition > Traffic acquisition, đổi thuộc tính chính thành Session default channel group và tìm hàng AI Assistant. Nếu hàng này xuất hiện, phân loại tích hợp đã chạy trên thuộc tính của bạn. Tính năng được triển khai rộng rãi đến đầu tháng 6 năm 2026. Ngày «triển khai rộng rãi» chính xác chỉ có nguồn thứ cấp; Google ghi ngày 13 tháng 5 cho logic phân loại nhưng không ghi riêng mốc khả dụng.

Bước 2 — xây dựng nhóm kênh tùy chỉnh

Mở Admin > Data display > Channel groups > Create new channel group. GA4 đôi khi thay đổi bố cục Admin; nếu đường dẫn đã chuyển, hãy tìm “Channel groups” trong Admin và xác minh giao diện trực tiếp trước khi dựa vào bất kỳ ảnh chụp màn hình nào.

  1. Đặt tên nhóm, chẳng hạn “AI + Default”, để nhận ra ngay mục đích.
  2. Chọn Add new channel và đặt tên AI.
  3. Đặt điều kiện Sourcematches regex, rồi dán mẫu có neo và giới hạn theo miền trong tab Scripts. Không dùng mẫu quá rộng kiểu “chuỗi bất kỳ chứa ai”; nó sẽ nhận nhầm các miền như mail.comwikipedia.org.
  4. Kéo kênh AI lên trên Referral. Đây là bước quyết định.
  5. Lưu cấu hình.

Các trường hỗ trợ đối sánh gồm Campaign ID, Campaign name, Default channel group, Manual ad content, Medium, Source và Source platform. Để tăng độ bao phủ, thêm điều kiện thứ hai cho utm_source chứa chatgpt, qua đó nhận cả thẻ do ChatGPT Search tự thêm.

Bước 3 — đặt đúng thứ tự kênh để tránh lỗi âm thầm

Đây là câu quan trọng nhất trong toàn bộ quá trình thiết lập, trích nguyên văn từ tài liệu của Google: “Traffic is included in the first channel whose definition it matches given the current order of channels in the group.” (bản dịch) «Lưu lượng được đưa vào kênh đầu tiên có định nghĩa khớp với nó theo thứ tự kênh hiện tại trong nhóm.» Hãy đọc lại câu này trong bối cảnh lưu lượng AI. Một phiên từ chatgpt.com hợp lệ với Referral vì đó là miền giới thiệu. Nếu Referral nằm trên kênh AI, mọi phiên AI đều bị Referral nhận trước và không bao giờ đến được kênh AI.

Không có lỗi, cảnh báo hay dấu hiệu bất thường nào trong giao diện. Báo cáo chỉ âm thầm hiển thị lưu lượng AI bằng không hoặc gần bằng không, trong khi kênh AI không làm gì; bạn có thể mất cả buổi gỡ lỗi một regex vốn hoàn toàn đúng. Kéo AI lên trên Referral, lưu và xác nhận rằng hàng AI đã có phiên trong báo cáo Traffic acquisition dùng nhóm kênh tùy chỉnh của bạn.

Bước 4 — phần nhiều hướng dẫn bỏ qua: xây dựng Exploration

Kênh chỉ là một nhãn cho biết bạn nhận được bao nhiêu lưu lượng AI. Nó không cho biết trang nào nhận lưu lượng hay lưu lượng đó có chuyển đổi không, trong khi đây mới là điều các bên liên quan chú ý. Câu trả lời nằm trong Exploration.

Mở Explore > Blank (Free Form), sau đó:

  • Dimensions: thêm Session source / medium, Landing page + query string và, nếu cần, Session default channel group hoặc nhóm tùy chỉnh. Kéo Landing page vào Rows, còn Session source/medium vào hàng phụ hoặc cột.
  • Metrics: thêm Sessions, Engagement rate và chỉ số quan trọng nhất là Key events (chuyển đổi). Nếu có thương mại điện tử hoặc đã gán giá trị cho sự kiện chính, hãy thêm cả Revenue.
  • Lọc hoặc phân khúc theo nguồn AI. Bạn có thể lọc Session source/medium bằng matches regex cho các miền AI, nhưng tốt hơn là tạo một segment tái sử dụng được để áp dụng chế độ xem này cho mọi báo cáo.

Bây giờ bạn có bảng trả lời các câu hỏi thực tế: công cụ AI gửi lưu lượng đến trang đích nào, mức độ tương tác ra sao và lưu lượng đó tạo chuyển đổi gì.

Tạo phân khúc AI một lần, tái sử dụng ở mọi nơi

Trong bảng Segments của Exploration, chọn + > Build a new segment > Session segment. Đặt điều kiện Session source / medium matches regex với mẫu AI của bạn. Nếu muốn nhận lưu lượng có thẻ từ ChatGPT Search, thêm điều kiện OR cho utm_source chứa chatgpt. Đặt tên phân khúc là AI Sources. Sau đó bạn có thể:

  • Thêm nó vào bất kỳ Exploration nào cùng các phân khúc Organic Search, PaidReferral để so sánh cạnh nhau.
  • So sánh tỷ lệ tương tác và chuyển đổi của AI với các kênh khác trong cùng một bảng; bằng chứng này thuyết phục hơn nhiều so với số liệu chuyển đổi trích từ blog của người khác.

Phân khúc linh hoạt hơn kênh vì không bị ràng buộc với một báo cáo hay một vị trí nhóm kênh. Hãy xây dựng cả hai: dùng kênh để xem báo cáo nhanh và phân khúc để phân tích.

Bước 5 — báo cáo trang đích theo nguồn AI có tính hành động cao nhất

Nếu chỉ xây dựng một báo cáo từ bài viết này, hãy chọn báo cáo này. Đặt Landing page trong Rows, áp dụng phân khúc AI Sources, rồi dùng SessionsKey events làm chỉ số. Kết quả là danh sách xếp hạng các trang mà công cụ AI thực sự đưa người dùng đến, một chỉ báo hữu ích về nội dung nào đang giành được trích dẫn và truy xuất trong câu trả lời AI.

Hãy dùng đầu ra để đầu tư mạnh hơn vào những loại trang tập trung lưu lượng AI. Khi Ahrefs phân tích dữ liệu của mình, chúng tôi nhận thấy 80% lưu lượng tìm kiếm AI đến trang chủ, trang sản phẩm và công cụ miễn phí, chứ không phải bài blog. Đây chính là loại thông tin báo cáo này cung cấp: nó chỉ ra nơi nên đầu tư, thay vì buộc bạn phỏng đoán. Mức tập trung của bạn sẽ khác, nhưng dạng báo cáo vẫn giống nhau.

Bước 6 — báo cáo chuyển đổi và doanh thu cho lưu lượng AI

Số phiên chủ yếu để tham khảo; chuyển đổi mới là chỉ số giành được ngân sách. Hãy áp dụng phân khúc AI Sources cho báo cáo sự kiện chính/chuyển đổi tiêu chuẩn, hoặc so sánh trực tiếp trong Exploration bằng Sessions, Key events và Revenue nếu có, chia theo AI, Organic và Paid. Điều thường thuyết phục các bên liên quan là tỷ lệ chuyển đổi, không phải khối lượng. Lưu lượng AI thường chiếm ít phiên nhưng tạo chuyển đổi vượt tỷ trọng; một bảng cho thấy «AI chiếm 1% số phiên nhưng chuyển đổi gấp Nx Organic» sẽ thay đổi toàn bộ cuộc trao đổi. Các số liệu mức tăng cụ thể — 23x và 10,21% so với 2,46% của Loamly — thuộc bài viết về phân bổ. Hãy dùng số liệu của chính bạn từ báo cáo này thay vì trích số liệu của họ.

Bước 7 — gắn thẻ UTM tùy nền tảng, không phải “AI xóa mọi thứ”

Khẳng định phổ biến rằng «nền tảng AI xóa mọi UTM nên việc gắn thẻ là vô ích» sai theo cả hai chiều. Thực tế năm 2026 như sau:

  • ChatGPT ngày càng tự thêm utm_source=chatgpt.com vào một số liên kết đi, đặc biệt từ ChatGPT Search. Đây là trường hợp hiếm khi nền tảng AI giúp phân bổ dễ hơn, nên hãy nhận diện nó bằng điều kiện utm_source trong kênh hoặc phân khúc. Search Engine Roundtable từng đưa tin OpenAI mở rộng hành vi này; trang trả về 403 khi nghiên cứu, nhưng nhiều nguồn thứ cấp xác nhận cùng xu hướng.
  • Perplexity, Gemini và Claude thường không thêm hoặc giữ UTM trên liên kết trích dẫn. Không nhà cung cấp nào ghi lại hành vi liên kết đi, nên kết luận này dựa trên kiểm thử độc lập chứ không phải tài liệu chính thức.
  • UTM không giúp với liên kết bạn không kiểm soát. Công cụ AI trích dẫn URL canonical mà nó tìm thấy, không phải URL có thẻ mà bạn muốn. Bạn không thể gắn UTM để giải quyết phân bổ cho các trích dẫn đó.

UTM vẫn hữu ích với liên kết do bạn tự đặt trong nội dung đi như bản tin, nội dung phân phối lại hoặc nội dung thu hút trích dẫn đăng ở nơi khác, nơi bạn kiểm soát URL và có thể gắn thẻ nếu nền tảng đích không xóa nó. Lợi ích nhỏ nhưng có thật; chỉ đừng kỳ vọng UTM giải quyết bài toán phân bổ trích dẫn, vì cấu trúc của hệ thống không cho phép.

Bước 8 — kết hợp Search Console để có bối cảnh về tính năng AI

Báo cáo hiệu suất Gen AI của Google (ngày 3 tháng 6 năm 2026) hiển thị số lần bạn xuất hiện trong “AI Overviews, AI Mode, and generative AI features in Discover” (bản dịch) «AI Overviews, AI Mode và các tính năng AI tạo sinh trong Discover», nhưng chỉ có lượt hiển thị: không có lượt nhấp, CTR hay vị trí. Vì vậy, GSC cũng không cung cấp “lượt nhấp AI Overview”.

Giải pháp thực tế là phép nối thủ công ở cấp URL; cần nói rõ rằng quy trình này hoàn toàn thủ công:

  1. Trong Search Console > Performance, lọc theo loại hình thức xuất hiện dành cho tính năng AI rồi xuất các trang có lượt hiển thị.
  2. Trong GA4, mở báo cáo trang đích ở Bước 5 và lấy Sessions/Key events cho chính các URL đó.
  3. Nối hai tệp xuất theo URL trang đích, không theo kênh. GA4 không thể tách lượt nhấp từ tính năng AI, nên phép nối theo kênh là bất khả thi.

Đầu ra cho biết URL nào xuất hiện trong tính năng AI qua lượt hiển thị GSC hiệu quả của chính URL đó trong GA4 qua phiên và chuyển đổi. Nếu đã liên kết GA4 với GSC qua Admin > Product links > Search Console links, một phần dữ liệu sẽ có trong báo cáo Search Console của GA4. Tuy nhiên, phần tính năng AI vẫn cần nối thủ công vì không sản phẩm nào gắn nhãn phiên là «đến từ AI Overview». Đây là một quy trình, không phải nút bấm.

Hãy đối chiếu tương tự với báo cáo AI Performance của Bing Webmaster Tools (bản xem trước công khai, tháng 2 năm 2026). Báo cáo cung cấp trích dẫn và các truy vấn grounding mà Copilot dùng để tìm bạn. Referrer của Copilot không nhất quán: bản web đôi khi gửi, còn ứng dụng Windows không bao giờ gửi. Vì vậy regex GA4 luôn đếm thiếu Copilot; số trích dẫn của Bing là dữ liệu đối chiếu.

Những giới hạn còn lại

Cần nêu rõ một số giới hạn trước khi chuyển sang bước tiếp theo:

  1. Mức sàn 35–70% không thay đổi. Bạn đo tốt phần có referrer; phần không có vẫn ở Direct.
  2. Không thể tách AI Overviews / AI Mode vì định nghĩa kênh của Google gộp chúng vĩnh viễn vào Organic Search.
  3. Báo cáo dài hạn bị giới hạn bởi thời gian lưu dữ liệu. Data retention ở cấp sự kiện của GA4, trong Admin > Data settings > Data retention, mặc định là 2 tháng và tối đa 14 tháng. Exploration dùng dữ liệu cấp sự kiện không thể nhìn xa hơn, và ngày bắt đầu thuộc tính là ranh giới cứng thứ hai. Khi tín hiệu đồng ý dưới ngưỡng báo cáo, các hàng ít dữ liệu có thể bị mô hình hóa hoặc ẩn. Đừng hiểu hàng bị thiếu là «không có lưu lượng AI»; nó có thể dưới ngưỡng hoặc ngoài thời gian lưu.
  4. Sửa nhóm kênh có thể đổi cả cách đọc ngày quá khứ. Đổi tên, thứ tự hoặc thêm quy tắc có thể phân loại lại phiên đã thu thập khi truy vấn theo quy tắc hiện tại. Hãy ghi ngày mỗi lần sửa regex để tránh làm sai lệch so sánh theo tháng.
  5. So sánh chuyển đổi ở Bước 6 đếm theo phiên, không phải tín dụng phân bổ đa điểm chạm. Exploration đếm Sessions và Key events trực tiếp. Attribution reports áp dụng mô hình phân bổ đã chọn, mặc định dựa trên dữ liệu, nên có thể gán cho AI tỷ trọng khác trong hành trình nhiều điểm chạm. Nếu cần tín dụng đa điểm chạm, hãy lấy số từ Attribution thay vì kỹ thuật Exploration ở Bước 4–6.

Để hiểu đầy đủ vì sao lưu lượng bị ẩn và cách xử lý đường cơ sở Direct, hãy đọc bài phân bổ lưu lượng AI. Để xem vai trò của GA4 trong phương pháp đo lường năm lớp, hãy xem trung tâm đo lường và báo cáo. Bài này phụ trách cấu hình; hai tài nguyên đó phụ trách chiến lược.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.