Chủ đề
Indexing & Crawling
Thư viện
1 bài
Thuật ngữ
8 bài
-
Khi Nào Sửa Link Gãy, Khi Nào Redirect, Khi Nào Giữ 404?
Khi nào sửa link gãy: khi nào sửa link, redirect 301, giữ 404, dùng 410, xử lý soft 404, redirect chain và broken anchor đúng intent.
-
Redirect Mapping 301/308: Cách Dựng Map Không Phá Intent Và Không Tạo Chain
Redirect Mapping 301/308: cách map URL cũ sang URL mới theo intent, tránh redirect chain, sửa canonical, sitemap và internal link sau khi đổi URL.
-
Bot Traffic là gì - Chặn bot, nuôi bot, tối ưu AI cite
Bot Traffic là lưu lượng do bot tạo ra. Hướng dẫn đọc log phân biệt bot thật – bot giả, checklist chặn bot theo lớp (WAF/CDN, Nginx/Apache, WordPress, robots.txt), và cách “nuôi bot” để tối ưu crawl và tăng khả năng được AI trích dẫn.
-
Indexifembedded & Noindex: Kỹ thuật kiểm soát lập chỉ mục chuyên sâu
Việc kiểm soát Google lập chỉ mục trang nào không chỉ đơn thuần là dùng tệp robots.txt. Ở mức độ chuyên gia, bạn cần sử dụng các thẻ Meta Robots để ra lệnh trực tiếp cho Google Bot về cách xử lý từng đơn vị nội dung, đặc biệt là khi nội dung đó được nhúng qua iFrame hoặc các nền tảng của bên thứ ba.
-
JavaScript SEO & Rendering: Kỹ thuật điều phối trình kết xuất cho Google Bot
Trong SEO hiện đại, JavaScript (JS) là một con dao hai lưỡi. Một mặt, nó tạo ra trải nghiệm người dùng (UX) tuyệt vời; mặt khác, nó tạo ra rào cản khổng lồ cho việc lập chỉ mục nếu không được xử lý đúng cách. Google thực thi JS thông qua một quy trình hai giai đoạn (Two-pass Indexing), và hiểu được
-
Sitemap Index & Large Sites: Chiến thuật phân tầng cho Website quy mô lớn
Theo quy định của Google, một tệp XML Sitemap chỉ chứa tối đa 50.000 URL và dung lượng không quá 50MB. Đối với các trang thương mại điện tử (TMĐT) có hàng trăm nghìn sản phẩm hoặc báo chí có hàng triệu bài viết, bạn bắt buộc phải sử dụng Sitemap Index (Sitemap mẹ) để quản lý các Sub-Sitemap (Sitemap
-
Crawl Budget Optimization: Kỹ thuật quản trị tài nguyên cho Website lớn
Ngân sách thu thập dữ liệu (Crawl Budget) là số lượng URL mà Googlebot có thể và muốn thu thập dữ liệu trên website của bạn trong một khoảng thời gian nhất định. Nếu website có 50.000 trang nhưng Google chỉ cấp ngân sách 10.000 trang/ngày, sẽ mất ít nhất 5 ngày để bài mới được Index. Tối ưu hóa Craw
-
Advanced Robots.txt Rules: Kỹ thuật điều phối Bot và Tối ưu hóa Crawl Budget
Trong SEO Technical, tệp robots.txt là tuyến phòng thủ đầu tiên. Việc nắm vững các quy tắc nâng cao và biểu thức chính quy (Regex) không chỉ giúp bạn tiết kiệm tài nguyên máy chủ mà còn trực tiếp tác động đến tốc độ lập chỉ mục của bài viết, giúp nội dung sớm xuất hiện trong Google Search và AI Over
Chủ đề liên quan
Cùng xuất hiện trong các bài trên.