Questo č quello che succede quando uno spider naviga il nostro sito:
a) Legge il nome di dominio
b) Legge il nome di tutte le directory
c) Legge i title di tutte le pagine
d) Legge il contenuto di tutti i meta tag
e) Legge tutti i titoli evidenziati (grassetto, <h1>, <h2>)
f) Legge il testo di tutti i link che puntano all'esterno
g) Legge le definizioni di tutti gli ALT delle immagini
h) Legge il nome di tutte le ancore (la parte dopo il # nei link)
i) Legge il testo contenuto nel <body></body> di tutte le pagine
Successivamente le informazioni raccolte vengono filtrate in questo modo:
a) Vengono cancellate tutte le parole superflue come 'e', 'di', etc.
b) Vengono identificate le parole chiave ricorrenti
c) Vengono identificate le frasi chiave
d) Viene stabilito il peso delle parole chiave con il metodo tradizionale (cioč analizzando i meta tag e i title in particolare)
e) Viene stabilito il tema del sito considerando la prevalenza di alcune parole e frasi chiave rispetto alle altre
Al termine di questa analisi il sito verrā indicizzato per le frasi/parole chiave pių rilevanti.
Gli spider non sono ovviamente in grado di comprendere il significato delle parole, ma solo di valutarne la ricorrenza e la rilevanza.
Risulta quindi come sia veramente importante comprendere a pieno qual'č il vero messaggio che vogliamo trasmettere attraverso il nostro sito e cercare di renderlo il pių uniforme possibile rispetto a quel messaggio.
Il che significa creare un sito ricco di contenuti testuali, ben organizzato attorno ad un nucleo centrale assolutamente chiaro e comprensibile.