Bersihkan Crawl Budget: Hapus Tag dan Halaman Low-Value (Arsip Penulis, Tag yang Jarang Digunakan, Kategori Kosong) dari Sitemap Anda. Gunakan Robots.txt Hanya untuk Memblokir URL yang Memang Tidak Pernah Boleh Diindeks (Misalnya, Halaman Login, Dashboard).
Pendahuluan
-
Definisi Crawl Budget: Jelaskan apa itu Crawl Budget (Anggaran Perayapan) dan mengapa penting bagi kesehatan SEO, terutama untuk situs besar seperti yang pernah kamu tangani di perusahaan unicorn.
-
Masalah Low-Value Pages: Kenalkan masalah utama: banyak situs membuang-buang anggaran perayapan untuk halaman-halaman yang tidak memberikan nilai SEO (low-value pages).
-
Tujuan Artikel: Menjelaskan strategi ganda untuk mengoptimalkan Crawl Budget: membersihkan Sitemap dan menggunakan
robots.txtsecara strategis.
I. Mengapa Halaman Low-Value Menguras Crawl Budget?
-
Pemborosan Sumber Daya: Setiap URL yang ada di Sitemap adalah permintaan kepada Googlebot. Jika URL tersebut tidak penting, Googlebot menghabiskan waktu untuk merayapinya, bukan merayapi konten utama kamu.
-
Contoh Halaman Low-Value:
-
Arsip Penulis tunggal (jika tidak ada branding khusus).
-
Tag atau Kategori yang hanya memiliki 1-2 postingan atau bahkan kosong.
-
Halaman hasil pencarian internal.
-
Halaman feed (RSS/Atom).
-
-
Dampak pada Indeks: Halaman penting akan lebih lambat diindeks atau diperbarui karena Googlebot sibuk merayapi halaman sampah.
II. Strategi 1: Pembersihan Komprehensif Sitemap XML Anda
-
Prinsip Dasar: Sitemap kamu harusnya hanya berisi URL yang kamu ingin diindeks dan sering dirayapi.
-
Langkah Aksi #1: Audit Halaman Arsip/Penulis:
-
Jika situs hanya memiliki satu atau dua penulis, arsip penulis seringkali duplikat dari halaman utama blog. Hapus dari Sitemap.
-
Gunakan
noindexpada halaman arsip yang kurang berharga, tetapi pastikan tidak ada di Sitemap.
-
-
Langkah Aksi #2: Mengatasi Tag dan Kategori yang Jarang Digunakan:
-
Identifikasi tag atau kategori dengan jumlah postingan sangat sedikit (misalnya, < 5).
-
Jika tag tersebut tidak memberikan nilai tematik yang unik, Hapus dari Sitemap dan pertimbangkan untuk menggabungkannya ke kategori yang lebih besar.
-
Hapus Kategori atau Tag yang benar-benar Kosong dari Sitemap.
-
-
Langkah Aksi #3: Prioritas Konten Utama: Pastikan semua halaman penting (money pages, artikel utama, landing page) ada di Sitemap dan memiliki prioritas yang jelas.
III. Strategi 2: Penggunaan Robots.txt yang Tepat dan Terbatas
-
Mitos Robots.txt: Jelaskan bahwa
robots.txtBUKAN cara untuk menyembunyikan halaman agar tidak diindeks. Tujuan utamanya adalah mencegah Googlebot merayapi (mengunjungi) URL tertentu, menghemat Crawl Budget. -
Kapan Menggunakan
robots.txt(Hanya untuk Memblokir Crawling):-
Halaman Login (e.g., /wp-admin, dashboard admin).
-
Halaman Pengaturan Pengguna atau Keranjang Belanja yang bersifat internal.
-
URL duplikat hasil filtering (jika canonical tidak memungkinkan).
-
-
Peringatan Penting: JANGAN gunakan
robots.txtpada halaman yang sudah terlanjur diindeks dan kamu ingin menghapusnya. Jika diblokir, Googlebot tidak akan melihat perintahnoindexyang mungkin ada di halaman tersebut, menyebabkan halaman tetap ada di hasil pencarian (dapat dirayapi tetapi tidak diindeks).
Kesimpulan ( Kata)
-
Ringkasan Poin Utama: Optimalisasi Crawl Budget adalah tentang efisiensi.
-
Sitemap: Harus bersih dan hanya berisi halaman yang kamu ingin diindeks.
-
Robots.txt: Gunakan hanya untuk memblokir akses ke area yang memang tidak pernah boleh dirayapi dan tidak ada nilai SEO.
-
-
Pesan Akhir: Dengan mengarahkan Googlebot ke konten bernilai tinggi, kamu memastikan bahwa upaya SEO kamu memberikan dampak maksimal pada peringkat dan visibilitas.