Temukan dan validasi semua sitemap di website mana pun secara instan. Temukan sitemap tersembunyi, cek validitasnya, dan ambil total jumlah URL. Cocok untuk audit SEO dan analisis website.
Masukkan URL website apa pun untuk menemukan semua sitemap yang tersedia. Tool akan mengecek robots.txt untuk deklarasi sitemap dan memindai lokasi sitemap yang umum. Tool juga memvalidasi aksesibilitas dan menghitung jumlah URL dari setiap sitemap yang ditemukan.
Masukkan domain utama (misalnya example.com). Tool akan mencari sitemap secara otomatis.
Sitemap Finder & Checker adalah tool yang secara otomatis menemukan semua sitemap di website mana pun. Tool ini melakukan pemindaian menyeluruh dengan mengecek file robots.txt untuk deklarasi sitemap dan menguji lokasi sitemap umum tempat webmaster biasanya meletakkan sitemap mereka.
Berbeda dengan pencarian manual, tool ini mengotomatiskan seluruh proses penemuan. Tool mengecek lebih dari 20 lokasi sitemap umum, termasuk path standar seperti /sitemap.xml, path khusus platform seperti /wp-sitemap.xml untuk WordPress, dan sitemap khusus konten seperti /post-sitemap.xml, /product-sitemap.xml, dan lainnya.
Untuk setiap sitemap yang ditemukan, tool memvalidasi aksesibilitasnya, mengecek kode status HTTP, mengambil metadata seperti content type dan ukuran file, serta menghitung total jumlah URL. Analisis menyeluruh ini membantu Anda memahami struktur sitemap sebuah website dan menemukan masalah aksesibilitas.
/sitemap.xml/sitemap_index.xml/sitemap-index.xml/sitemaps.xml/post-sitemap.xml/page-sitemap.xml/product-sitemap.xml/category-sitemap.xml/wp-sitemap.xml/blog/sitemap.xml/sitemap/sitemap.xml/news-sitemap.xml/video-sitemap.xml/image-sitemap.xmlReferensi di robots.txtSebagian besar crawler mengecek /sitemap.xml dan daftar pendek variasi umumnya. Sitemap di path yang tidak biasa, seperti /wp-sitemap-posts-post-1.xml atau subdomain CDN, tidak akan terlihat kecuali ada yang menunjuk ke sana. Solusinya adalah mendeklarasikannya di robots.txt, satu-satunya tempat yang dicek oleh semua crawler.
Baris Sitemap: di robots.txt adalah cara memberi tahu crawler di mana harus mencari tanpa menebak-nebak. Cukup satu baris, berlaku untuk semua mesin pencari, dan inilah hal yang paling sering terlewat saat sebuah situs punya sitemap yang tidak bisa ditemukan.
Situs besar membagi sitemap menjadi file index yang menautkan ke sitemap turunan. Jika tool melaporkan satu sitemap yang hampir tidak berisi URL, kemungkinan Anda sedang melihat index-nya, bukan turunannya. Buka file tersebut dan ikuti entri di dalamnya.
Sitemap yang merespons dengan 404, 403, atau 500 dianggap tidak ada oleh crawler mana pun. Firewall dan proteksi bot sering menjadi penyebabnya, dan sering kali memblokir tools otomatis sementara file tetap tampil untuk Anda di browser.
Melarang akses ke direktori tempat sitemap berada akan mencegah crawler mengambilnya, meskipun URL-nya bisa diakses. Pastikan tidak ada aturan Disallow yang mencakup path sitemap itu sendiri.
Umum terjadi pada situs yang dibuat manual dan instalasi CMS yang fiturnya tidak pernah diaktifkan. Sitemap tidak wajib, dan situs kecil dengan link internal yang baik bisa di-crawl tanpanya, tetapi sitemap adalah jaminan murah untuk situs yang lebih dari beberapa puluh halaman.
/sitemap.xml di root domain adalah konvensinya, dan tidak ada keuntungan memakai lokasi lain. Yang lebih penting adalah robots.txt menunjuk ke sana dan Search Console mengetahuinya.
Tidak wajib, tetapi ini cara paling andal agar sitemap ditemukan. Tambahkan baris Sitemap: https://example.com/sitemap.xml dan setiap crawler yang membaca robots.txt akan menemukannya.
Tidak, dan ini adalah salah paham paling umum tentang sitemap. Sitemap membantu Google menemukan URL. Apakah Google akan meng-index-nya adalah penilaian terpisah berdasarkan kualitas setiap halaman. Sebuah halaman bisa berbulan-bulan ada di sitemap tanpa pernah terindex.
50.000 URL, atau 50MB tanpa kompresi, mana yang lebih dulu tercapai. Lebih dari itu, pecah menjadi beberapa file dan cantumkan dalam sitemap index. Sebagian besar plugin CMS menangani pemecahan ini secara otomatis.
Tidak. Sitemap sebaiknya berisi URL canonical yang mengembalikan status 200 dan memang ingin Anda index. Menyertakan halaman noindex, redirect, atau 404 mengirimkan sinyal yang bertentangan dan membuang perhatian crawler pada URL yang sudah Anda minta untuk diabaikan Google.
Kirimkan di Search Console, atau referensikan di robots.txt dan biarkan Google meng-crawl ulang. Endpoint ping sitemap lama sudah dihentikan Google pada 2024, jadi tools dan plugin yang masih melakukan ping sebenarnya tidak melakukan apa pun yang berguna.