Materi
Google Search Central membagi kerja mesin pencari menjadi tiga tahap, dan tidak semua halaman melewati ketiganya. Merayapi (crawling): program otomatis bernama perayap, pada Google disebut Googlebot, mengunduh teks, gambar, dan video dari halaman yang ditemukannya. Mengindeks (indexing): isi halaman dianalisis lalu disimpan di indeks, sebuah basis data besar. Menyajikan (serving): saat seseorang mencari, mesin pencari mengambil halaman yang paling relevan dari indeks.
| Tahap | Yang terjadi | Contoh penghambat |
|---|---|---|
| Merayapi | URL ditemukan lalu halamannya diunduh dan dirender | Server galat, aturan robots.txt, halaman butuh login |
| Mengindeks | Isi, title, alt, dan tag penting dianalisis lalu disimpan | Meta robots noindex, isi berkualitas rendah |
| Menyajikan | Halaman relevan dipilih untuk sebuah pencarian | Isi tidak relevan dengan kueri |
Tidak ada daftar pusat semua halaman web, jadi URL baru ditemukan lewat tautan dari halaman yang sudah dikenal, misalnya halaman kategori yang menautkan artikel baru, atau lewat sitemap yang dikirim pemilik situs. Saat mengindeks, Google juga mengelompokkan halaman yang isinya mirip dan memilih satu yang paling mewakili; halaman itu disebut kanonis dan dibahas di modul 3. Relevansi saat menyajikan ditentukan ratusan faktor, termasuk lokasi, bahasa, dan perangkat pencari.
Dua pernyataan di halaman yang sama menjadi pegangan seluruh kelas ini. Google tidak menerima bayaran untuk merayapi situs lebih sering atau menaikkan peringkatnya. Google juga tidak menjamin akan merayapi, mengindeks, atau menyajikan sebuah halaman, meskipun halaman itu mengikuti panduannya. Yang bisa dikerjakan pemilik halaman adalah menghilangkan penghambat di tiap tahap.