Ti trovi qui:
Topologia della mappa del sito in B2C Commerce
Per includere il sito nei risultati di ricerca, Google utilizza un googlebot come crawler del sito. Google si tiene aggiornato sulle pagine nuove del sito attraverso la mappa del sito fornita. Quando Google richiede la mappa del sito, la pipeline SiteMap nell'applicazione la consegna a Google attraverso il pipelet SendGoogleSiteMap. Questo argomento si applica a B2C Commerce.
La mappa del sito è composta da un file di indice (sitemap_index.xml) e uno o più file di mappa del sito effettivi (sitemap_0.xml, sitemap_1.xml, ...).
Il file di indice è il file che viene registrato con il motore di ricerca e contiene le ubicazioni di tutti i file di mappa del sito. Il suo unico scopo è puntare alle effettive mappe del sito. Il numero effettivo di file di mappa del sito viene stabilito in base agli URL configurabili per ogni file di mappa del sito (ad esempio 50.000) o a una dimensione massima di 10 MB per file di mappa del sito, a seconda della condizione che si verifica per prima.
Il googlebot indicizza il sito per indicare con esattezza a Google le informazioni incluse in ogni pagina. Il googlebot utilizza il file robots.txt per determinare le parti del sito da indicizzare. I googlebot non indicizzano le parti del sito non ammesse dal file robots.txt, anche se gli URL sono inclusi nella mappa del sito.
Generare un file robots.txt utilizzando gli strumenti per Webmaster di Google e utilizzarlo su diversi siti. Inoltre, si può generare il file robots.txt in Business Manager e presentarlo ai crawler per ciascun sito.
