Tìm kiếm tác nhân

Tìm kiếm tác nhân là AI tự lập kế hoạch, duyệt web và tổng hợp một tác vụ nghiên cứu nhiều bước thay vì chỉ trả lời một truy vấn.

Xuất bản lần đầu: 24 thg 6, 2026 · Cập nhật lần cuối: 22 thg 8, 2026 · Advanced
Ngôn ngữ
1 tín hiệu bằng chứng trên trang này

Tìm kiếm tác nhân là AI tự duyệt web, nghiên cứu và tổng hợp trong nhiều phút thay vì chỉ trả lời một truy vấn. Điểm kỹ thuật quan trọng: trình duyệt tác nhân chạy máy ảo Chrome hoặc Edge thật, nên robots.txt không thể chặn chúng; cần kiểm soát phía máy chủ.

Tóm tắt — Tìm kiếm tác nhân là lớp thứ ba của tìm kiếm (truyền thống → tìm kiếm AI → tác nhân): hệ thống chạy vòng lặp nhiều bước — Lập kế hoạch → Tìm kiếm → Đọc → Đánh giá → tìm lại → tổng hợp/hành động — trong nhiều phút, phát 20–160+ truy vấn mỗi phiên và đọc toàn bộ nội dung trang thay vì snapshot lưu trong bộ nhớ đệm. Xét về kiểm soát, nền tảng chia thành hai nhóm. Crawler có khai báo (Gemini-Deep-Research, Claude-User) tôn trọng robots.txt. Trình duyệt tác nhân (ChatGPT Agent, Project Mariner, Copilot Actions) chạy máy ảo Chrome/Edge thật mà không khai báo user-agent bot; robots.txt không thể chạm tới chúng, chỉ biện pháp phía máy chủ hoặc RFC Web Bot Auth đang hình thành mới có thể tác động. Lợi ích: traffic do AI giới thiệu chuyển đổi tốt hơn khoảng 42% so với traffic không đến từ AI, và traffic tác nhân là phần có ý định cao nhất trong đó.

Tìm kiếm tác nhân là lớp thứ ba, không phải sự thay thế

Mô tả hiện tại của các nhà cung cấp cho thấy khả năng nghiên cứu nhiều bước và dùng công cụ, chứ không chứng minh việc thay thế retrieval hay xếp hạng trên mọi hệ thống. Evidence for this claim Deep-research products can perform multi-step web research and synthesize cited results. Scope: Documented product capabilities, not a universal definition or ranking architecture for agentic search. Confidence: high · Verified: OpenAI: Introducing deep research Các sơ đồ pipeline ở đây là mô hình giải thích, trừ khi nhà cung cấp ghi rõ. Evidence for this claim The term agentic search covers an evolving set of vendor implementations whose tools and behavior can differ. Scope: Editorial synthesis from documented product behavior; implementations and releases may vary. Confidence: medium · Verified: OpenAI: Introducing deep research

Mô hình tư duy tôi thường quay lại là:

  • Tìm kiếm truyền thống trả về liên kết; con người đọc và quyết định.
  • Tìm kiếm AI — mục tiêu của GEO/AEO như AI Overviews, câu trả lời ChatGPT và Perplexity — trả về một câu trả lời được tổng hợp từ ngữ cảnh đã truy xuất.
  • Tìm kiếm tác nhân chia mục tiêu thành nhiệm vụ con, tự chọn công cụ, đọc toàn bộ trang, lặp lại dựa trên điều học được rồi kết thúc bằng báo cáo tổng hợp hoặc một hành động như mua hàng, đặt chỗ hay điền biểu mẫu.

Semrush diễn đạt mối quan hệ này rất rõ: “All agentic search is AI search. Not all agentic search is the same thing as AI search.” (bản dịch) «Mọi tìm kiếm tác nhân đều là tìm kiếm AI. Không phải mọi tìm kiếm tác nhân đều đồng nghĩa với tìm kiếm AI.» Cách nói ngắn gọn dễ nhớ là mọi tìm kiếm tác nhân đều là tìm kiếm AI; không phải mọi tìm kiếm AI đều mang tính tác nhân. Điều này không thay thế SEO truyền thống. Authority, khả năng lập chỉ mục và dữ liệu có cấu trúc vẫn là điều kiện tiên quyết; tối ưu cho tác nhân bổ sung tính đầy đủ, khả năng máy đọc và độ rõ của thực thể.

Hệ thống tác nhân thực sự hoạt động thế nào

Điểm khác biệt cốt lõi so với RAG hoặc một lần retrieval đơn lẻ là retrieval diễn ra giữa quá trình suy luận, theo vòng lặp:

Agentic retrieval happens inside the reasoning loop: evaluate what is missing, search again, then synthesize or act.

An agent begins by breaking a goal into sub-tasks. It formulates one or more searches, fetches and reads live sources, and evaluates gaps, conflicts, and evidence. When evidence is missing, it revises the query and loops back to search. Once the task is sufficiently supported, it synthesizes a report or takes an allowed action. This is an explanatory model; products vary and do not all expose or implement every step identically.

Firecrawl mô tả đây là phương pháp trong đó tác nhân “decides when to search, formulates the query from context, reads actual page content from each result, and evaluates what it found before deciding whether to synthesize or search again.” (bản dịch) «tự quyết định khi nào cần tìm kiếm, tạo truy vấn từ ngữ cảnh, đọc nội dung trang thật của từng kết quả và đánh giá điều tìm thấy trước khi quyết định tổng hợp hay tìm lại». Các hệ quả thực tế:

  • Đọc trang theo thời gian thực, không đọc bản tóm tắt đã lập chỉ mục. Tác nhân lấy và đọc toàn bộ nội dung đang hoạt động. Độ mới và khả năng truy cập trực tiếp quan trọng hơn so với tìm kiếm truyền thống; chúng không chỉ làm việc từ snapshot đã lưu.
  • Lặp lại việc điều chỉnh truy vấn. Nếu kết quả lỗi thời hoặc lệch mục tiêu, tác nhân viết lại truy vấn — chẳng hạn thêm “2026” khi gặp tài liệu đã ngừng dùng — rồi thử lại.
  • Nối chuỗi công cụ. Một tác vụ có thể kết hợp tìm kiếm web, thực thi code, đọc tệp và gửi biểu mẫu.

Bao nhiêu lượt tìm kiếm trong mỗi phiên

Đây không phải một truy vấn duy nhất. Quy mô theo nền tảng:

Sản phẩmLượt tìm kiếm mỗi phiênThời lượng
Perplexity Deep Research20–50 truy vấn2–4 phút
Gemini Deep Research~80 (tiêu chuẩn); ~160 (Max)tối đa 60 phút (phần lớn < 20)
OpenAI Deep Researchchưa công bố; “tens of minutes” (bản dịch) «hàng chục phút»10–30+ phút
Project Marinerduyệt theo tác vụ (tối đa 10 tác vụ đồng thời)theo tác vụ
ChatGPT Agenttối đa ~10 tác vụ đồng thờitheo tác vụ

Nghiên cứu SAGE của Google cho thấy các tác nhân AI thực hiện trung bình 4,9 bước cho mỗi truy vấn — tìm kiếm, so sánh và đánh giá nhiều nguồn trước khi đưa ra kết quả.

Các nền tảng tác nhân lớn

OpenAI — Deep Research + ChatGPT Agent. Deep Research (o3-deep-research / o4-mini-deep-research) được xây dựng để “find, analyze, and synthesize hundreds of sources to create a comprehensive report at the level of a research analyst,” (bản dịch) «tìm, phân tích và tổng hợp hàng trăm nguồn để tạo báo cáo toàn diện ở cấp độ một chuyên viên nghiên cứu», và OpenAI cảnh báo yêu cầu “can take a long time.” (bản dịch) «có thể mất nhiều thời gian». ChatGPT Agent kế nhiệm Operator — một phiên Chromium chạy trên đám mây, duyệt web thật và có thể chạy khoảng 10 tác vụ đồng thời. Các bot retrieval của nó (OAI-SearchBot, ChatGPT-User) có khai báo; trình duyệt tác nhân thì không.

Google — Gemini Deep Research + Project Mariner. Gemini Deep Research chạy vòng lặp rõ ràng “Plan → Search → Read → Iterate → Output” (bản dịch) «Lập kế hoạch → Tìm kiếm → Đọc → Lặp lại → Đầu ra». Google mô tả hệ thống “continuously refin[ing] its analysis, browsing the web by searching and finding interesting pieces of information then starting a new search based on what it’s learned, repeating this process multiple times before generating a comprehensive report.” (bản dịch) «liên tục tinh chỉnh phân tích, duyệt web để tìm thông tin đáng chú ý rồi bắt đầu lượt tìm kiếm mới dựa trên điều đã học, lặp lại nhiều lần trước khi tạo báo cáo toàn diện». Hệ thống có user-agent Gemini-Deep-Research được khai báo và tôn trọng robots.txt. Project Mariner là tác nhân tự động hóa trình duyệt, hỗ trợ tối đa 10 tác vụ đồng thời; nó dùng dấu vân tay Chrome tiêu chuẩn từ máy ảo đám mây và không khai báo user-agent bot.

Perplexity — Deep Research / Sonar. Perplexity “performs dozens of searches, reads hundreds of sources, and reasons through the material to autonomously deliver a comprehensive report” (bản dịch) «thực hiện hàng chục lượt tìm kiếm, đọc hàng trăm nguồn và suy luận trên tài liệu để tự tạo báo cáo toàn diện» — 20–50 truy vấn trong 2–4 phút. PerplexityBot được khai báo là tôn trọng robots.txt. Tháng 8 năm 2025, Cloudflare báo cáo đã quan sát các crawler không khai báo mà họ quy cho Perplexity truy cập nội dung bất chấp chỉ thị cấm crawl; Perplexity phản bác tường thuật của Cloudflare. Ngoài ra, tài liệu Perplexity nói Perplexity-User thường bỏ qua robots.txt vì đây là lượt lấy dữ liệu do người dùng yêu cầu.

Anthropic — Claude web search + computer use. Claude-User — các lượt lấy dữ liệu thời gian thực do người dùng khởi tạo — tôn trọng robots.txt. Khi Claude chạy ở chế độ computer use, nó điều khiển trình duyệt tiêu chuẩn và không phát user-agent bot được khai báo, cùng mô hình trình duyệt tác nhân như Mariner và ChatGPT Agent.

Microsoft — Copilot + Copilot Actions. Retrieval web bên dưới Copilot dùng Bingbot, vốn tôn trọng robots.txt. Copilot Actions — duyệt web bằng tác nhân — dùng user-agent Edge/Chromium tiêu chuẩn và không có tín hiệu bot được khai báo, nên không thể phân biệt với người duyệt web ở tầng user-agent.

User-agent và khoảng trống của robots.txt

Đây là phần dễ gây nhầm lẫn, nên bảng sau gom toàn cảnh:

Bot / tác nhânTín hiệu user-agentrobots.txtLoại
GPTBot…compatible; GPTBot/1.3Tôn trọngHuấn luyện
OAI-SearchBot…compatible; OAI-SearchBot/1.3Tôn trọngChỉ mục tìm kiếm
ChatGPT-User…compatible; ChatGPT-User/1.0Chưa rõ từ tháng 12/2025Do người dùng kích hoạt
ChatGPT AgentUser-agent Chrome tiêu chuẩn + header Signature-AgentKhông có tín hiệuTrình duyệt tác nhân
ClaudeBot…compatible; ClaudeBot/1.0Tôn trọngHuấn luyện
Claude-SearchBotClaude-SearchBotTôn trọngChỉ mục tìm kiếm
Claude-User…compatible; Claude-User/1.0Tôn trọngDo người dùng kích hoạt
PerplexityBot…compatible; PerplexityBot/1.0Nói là có; Cloudflare phản bác mức tuân thủChỉ mục tìm kiếm
Perplexity-User…compatible; Perplexity-User/1.0Thường bỏ quaDo người dùng kích hoạt
Gemini-Deep-Research…compatible; Gemini-Deep-Research; +https://gemini.google/…Tôn trọngTác nhân nghiên cứu chuyên sâu
Google-AgentUser-agent Chrome tiêu chuẩnBỏ quaDo người dùng kích hoạt
Bingbot…compatible; bingbot/2.0Tôn trọngChỉ mục Search / Copilot
Copilot ActionsUser-agent Edge/Chromium tiêu chuẩnKhông có tín hiệuTrình duyệt tác nhân
Project MarinerUser-agent Chrome tiêu chuẩn (máy ảo đám mây)Không có tín hiệuTrình duyệt tác nhân

Các nhóm quan trọng là: crawler huấn luyệnbot chỉ mục tìm kiếm tôn trọng robots.txt; fetcher do người dùng kích hoạt có hành vi khác nhau — OpenAI khiến vị trí của ChatGPT-User kém rõ ràng hơn vào tháng 12 năm 2025; còn trình duyệt tác nhân bỏ qua tệp này theo thiết kế.

Điểm cần nhớ: robots.txt không thể chặn trình duyệt tác nhân

robots.txt là chỉ thị dành cho crawler. Trình duyệt tác nhân — ChatGPT Agent, Project Mariner, Copilot Actions và Claude ở chế độ computer use — khởi chạy phiên Chrome hoặc Edge thật trong máy ảo đám mây. Chúng xuất hiện như trình duyệt tiêu chuẩn, không khai báo danh tính bot và được xem là proxy trình duyệt thay vì crawler. Vì vậy:

  • Bạn có thể chặn bot huấn luyện (GPTBot, ClaudeBot) và bot chỉ mục tìm kiếm (OAI-SearchBot, Claude-SearchBot) trong robots.txt.
  • Bạn không thể chặn trình duyệt tác nhân ở đó. Chúng đơn giản không đọc tệp này.

Những biện pháp có tác dụng với tầng trình duyệt tác nhân là kiểm soát phía máy chủ — quy tắc dải IP, giới hạn tốc độ, quản lý bot ở edge — và RFC Web Bot Auth đang hình thành, dùng xác minh tác nhân bằng mật mã. ChatGPT Agent đã phát tín hiệu sớm: nó gửi HTTP Message Signature Signature-Agent: +"https://chatgpt.com" được ký bằng ed25519, là định danh phía máy chủ đáng tin cậy duy nhất cho nó. Trong analytics thông thường, lượt truy cập trực tiếp xuất hiện là “direct/(none)” hoặc “Bing/organic” khi nó tìm thấy bạn qua Bing.

Một hệ quả đáng nói rõ: chặn GPTBot không ngăn ChatGPT đọc trang của bạn theo thời gian thực. GPTBot là crawler huấn luyện. Deep Research và ChatGPT Agent tiếp cận nội dung qua các cơ chế hoàn toàn khác.

Tín hiệu nội dung nào quan trọng với AI tác nhân

Tác nhân đọc toàn bộ trang và đánh giá tính đầy đủ, khả năng trích dẫn, tính nhất quán và khả năng máy đọc. Từ nghiên cứu, những yếu tố thực sự hữu ích gồm:

  • Trang toàn diện, tập trung vào một chủ đề. Tác nhân đi sâu nhưng hẹp: chúng có thể đọc kỹ 5–10 trang thay vì lướt hàng trăm trang. Một trang trả lời đầy đủ chủ đề và các câu hỏi con hữu ích hơn nhiều so với năm trang mỏng. ALM Corp diễn đạt: “Structure gives agents stable extraction points — a page with clear headings, labeled sections and consistent formatting is easier to quote accurately.” (bản dịch) «Cấu trúc cung cấp cho tác nhân các điểm trích xuất ổn định; một trang có tiêu đề rõ, phần được gắn nhãn và định dạng nhất quán sẽ dễ được trích dẫn chính xác hơn.»
  • Nội dung có thẩm quyền, được trích dẫn và máy đọc được. Tác nhân đối chiếu với nguồn bên thứ ba và kho tri thức, nên trích dẫn bên ngoài giúp vượt ngưỡng tin cậy. Điều này phù hợp với kết quả tôi thấy ở AI Overviews: lượt nhắc trên các trang có nhiều liên kết tương quan ~0,70 (Spearman) với khả năng hiển thị AI — tín hiệu đơn mạnh nhất trong nghiên cứu đó và có thể cũng là dạng tín hiệu mà retrieval tác nhân dựa vào.
  • Dữ liệu có cấu trúc. JSON-LD không bắt buộc để được trích dẫn, nhưng cải thiện độ chính xác khi trích xuất; trong một thử nghiệm được dẫn nguồn, tỷ lệ trả lời đúng của GPT-4 tăng từ 16% lên 54% khi nội dung có dữ liệu có cấu trúc.
  • Tốc độ. Dữ liệu BrightEdge cho thấy các tác nhân ChatGPT rời trang tải chậm ngay lập tức; chúng ít kiên nhẫn hơn Googlebot. Điều này mở rộng kỷ luật Core Web Vitals sang bối cảnh tác nhân. Nội dung cũng phải truy cập được mà không cần thực thi JavaScript.
  • Phạm vi và đánh đổi rõ ràng. Trang nêu rõ giải pháp dành cho ai, không dành cho ai và những đánh đổi sẽ hữu ích hơn với tác nhân đang lập danh sách rút gọn so với nội dung cố làm hài lòng mọi người.

Vì sao đáng đầu tư: chất lượng chuyển đổi

Lượng traffic còn nhỏ nhưng chất lượng thì không. Tính đến tháng 3 năm 2026, traffic do AI giới thiệu chuyển đổi tốt hơn khoảng 42% so với traffic không đến từ AI, còn traffic tìm kiếm AI chuyển đổi khoảng 14,2% so với 2,8% của Google. Traffic tác nhân là tập con của traffic AI và gần như chắc chắn có ý định cao nhất, vì tác nhân chỉ đưa người dùng đến trang sau khi thay họ đánh giá các lựa chọn. Trở thành một trong số ít trang được tác nhân đọc và là trang được đề xuất có giá trị vượt trội.

Cách tư duy: SEO → GEO → ASO

Hãy coi tối ưu tác nhân là lớp thứ ba xếp trên hai lớp đầu, không phải sự thay thế. Nền tảng không đổi: authority, khả năng lập chỉ mục và dữ liệu có cấu trúc. Phần mới là tài nguyên toàn diện theo một chủ đề, khả năng máy đọc triệt để, thực thể rõ ràng, trích dẫn bên ngoài và nhận thức rằng robots.txt không còn là toàn bộ câu chuyện kiểm soát truy cập. Xem thẻ Checklists để có lượt kiểm tra cụ thể.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.