Quando crei il tuo primo progetto in Semrush, Site Audit viene configurato e avviato automaticamente per il dominio che hai inserito. Una volta completata la scansione iniziale, è possibile visualizzare i risultati in Site Audit dal pannello laterale o dalla home page.
Per tutti i progetti successivi che creerai, dovrai configurare Site Audit manualmente. Crea un nuovo progetto da Site Audit e segui le istruzioni per configurare e avviare la tua campagna di audit.
Se Site Audit non si avvia, consulta la risoluzione dei problemi di Site Audit.
Impostazioni generali
Il primo step della procedura guidata di configurazione è quello delle Impostazioni generali. Da qui, clicca su Avvia audit per eseguire un'analisi con le impostazioni predefinite oppure personalizza prima le impostazioni dell'audit. Puoi modificare le impostazioni e ripetere l'audit in qualsiasi momento per analizzare un'area più specifica del tuo sito.

Ambito
Per eseguire la scansione di un dominio, sottodominio o sottocartella specifici, inseriscili nel campo Ambito. Se inserisci un dominio, puoi anche selezionare la casella di controllo Scansiona tutti i sottodomini.
Per impostazione predefinita lo strumento scansiona il dominio principale, inclusi tutti i sottodomini e le sottocartelle disponibili del tuo sito. Per limitare la scansione, specifica un sottodominio o una sottocartella come ambito di scansione e deseleziona la casella Scansiona tutti i sottodomini.
Ad esempio, per scansionare solo il tuo blog, imposta l'ambito di scansione su blog.semrush.com o su semrush.com/blog/, in base a come è stato implementato (come sottodominio o come sottocartella).

Limite per audit
Ora inserisci nel campo Limite per audit il numero di pagine da analizzare. Questo numero si basa sul tuo abbonamento e sulla frequenza con cui riesamini il sito.
- Con il Toolkit SEO Pro puoi scansionare fino a 100.000 pagine al mese e 20.000 pagine per audit
- Con il Toolkit SEO Guru puoi scansionare fino a 300.000 pagine al mese e 20.000 pagine per audit
- Con il Toolkit SEO Business puoi scansionare fino a 1 milione di pagine al mese e 100.000 pagine per audit
Pagine da analizzare
L'impostazione Pagine da scansionare determina il modo in cui SiteAuditBot individua le pagine da analizzare. Oltre a impostare la fonte della scansione, puoi includere o escludere sottocartelle e parametri URL specifici nelle fasi Regole di allow/disallow e Regole dei parametri dell'URL.
Ci sono 4 fonti di scansione: Sito web, Sitemap Robots.txt, Sitemap dall'URL e Importa URL da file.
- Sito web: Site Audit scansiona il tuo sito utilizzando un algoritmo di ricerca di tipo breadth-first, seguendo i link presenti nel codice della tua pagina a partire dalla homepage. In questo modo vengono individuate le pagine più accessibili dalla tua homepage, che non sono sempre le più importanti. Per dare priorità in base all'importanza, utilizza la sitemap come fonte della scansione.
- Sitemap Robots.txt: Site Audit esegue la scansione solo degli URL presenti nella sitemap collegata al tuo file robots.txt
- Sitemap dall'URL: Site Audit esegue la scansione della sitemap che hai specificato. Inserisci direttamente l'URL della sitemap anziché fare affidamento sul link presente nel tuo file robots.txt. Site Audit utilizza un solo URL sitemap alla volta: se il tuo sito ha più sitemap, utilizza l'opzione Importa URL da file.
- Importa URL da file: Site Audit esegue la scansione di un insieme specifico di pagine che carichi tu. Fai in modo che il tuo file sia in formato .csv o .txt, con un URL per riga, quindi caricalo dal tuo computer. Usa questa opzione per verificare pagine specifiche e risparmiare sul budget di crawl. Dopo il caricamento, l'assistente mostrerà il numero di URL rilevati per confermare che il file sia stato letto correttamente.

Pianifica
Seleziona la frequenza con cui vuoi che Site Audit esegua l'audit del tuo sito:
- Settimanale (scegli un giorno qualsiasi della settimana)
- Giornaliero
- Una volta
Puoi eseguire nuovamente l'audit in qualsiasi momento.

Una volta configurate le impostazioni, clicca su Avvia audit.
Configurazione e impostazioni avanzate
I passaggi da 2 a 5 della procedura guidata di configurazione sono facoltativi. Usali per verificare quale user-agent effettua la scansione del tuo sito, la velocità di scansione, quali sottocartelle e parametri URL includere e come accedere alle pagine protette da restrizioni. Se le impostazioni predefinite sono adatte alle tue esigenze, puoi passare direttamente all'avvio dell'audit.
User agent
Qui puoi scegliere l'user-agent che Site Audit utilizzerà per eseguire la scansione del tuo sito. Le opzioni sono SiteAuditBot (Desktop), SiteAuditBot (Mobile) e OpenAI-Search: usa OpenAI-Search per verificare se il tuo sito è scansionabile dal bot di ricerca di OpenAI.
Per impostazione predefinita, Site Audit esegue la scansione con SiteAuditBot (Mobile), che analizza il tuo sito nello stesso modo in cui lo farebbe il crawler mobile di Google. Puoi passare a SiteAuditBot (Desktop) in qualsiasi momento.

Quando cambi l'user-agent, la stringa sotto il campo si aggiorna di conseguenza. Puoi copiare questa stringa in una richiesta cURL per testare l'user-agent.
Ritardo di scansione
Hai 3 opzioni per impostare il ritardo della scansione: Minimo, 1 URL ogni 2 secondi e Rispettare robots.txt.
Minimo: SiteAuditBot esegue il crawl alla sua velocità normale, attendendo circa 1 secondo prima di scansionare la pagina successiva. Questa è l'opzione predefinita e la più veloce.
1 URL ogni 2 secondi: SiteAuditBot rallenta a 1 URL ogni 2 secondi. Utilizza questa modalità se la scansione rallenta il tuo sito e non hai una direttiva sul ritardo di scansione (crawl delay) nel tuo file robots.txt. Il tuo audit richiede più tempo per essere completato, ma comporta meno problemi di velocità per i visitatori durante la scansione.
Rispettare robots.txt: SiteAuditBot rispetta il ritardo di scansione specificato nel tuo file robots.txt. Un ritardo di scansione appare così:
Crawl-delay: 20
Rendering JS
Attiva questa opzione per far eseguire a SiteAuditBot i tuoi file JavaScript e vedere gli stessi contenuti che vedono i tuoi visitatori. In questo modo i risultati del tuo crawl saranno più accurati e otterrai un quadro più chiaro della salute del tuo sito.
Con il rendering JS disattivato, Site Audit legge solo il tuo HTML: è più veloce e più leggero per il tuo sito, ma meno accurato per le pagine che utilizzano molto JavaScript.

Nota: Il rendering JS è disponibile per gli abbonamenti Guru e Business al Toolkit SEO.
Regole di allow/disallow
Usa questo step per eseguire la scansione o bloccare sottocartelle specifiche. Puoi specificare più sottocartelle contemporaneamente.
Inserisci tutto ciò che c'è nell'URL dopo il TLD. Ad esempio, per eseguire la scansione di http://www.example.com/shoes/mens/, inserisci /shoes/mens/ in Sottocartelle ammesse.

Per saltare una sottocartella, inserisci il relativo percorso in Sottocartelle escluse. Ad esempio, per scansionare la categoria delle scarpe da uomo ma saltare la sottocategoria degli scarponi da trekking su https://example.com/shoes/mens/hiking-boots/, inserisci /shoes/mens/hiking-boots/ in Sottocartelle escluse.

Importante: Includi lo slash finale. Se digiti /shoes invece di /shoes/, Site Audit salterà tutto nella sottocartella /shoes/ e ogni URL che inizia con /shoes, come www.example.com/shoes-men.
Regole dei parametri dell'URL
I parametri dell'URL, noti anche come stringhe di query, sono elementi di un URL che non rientrano nella struttura gerarchica del percorso. Vengono aggiunti alla fine di un URL e inviano istruzioni al browser web.
Un parametro URL è costituito da un punto interrogativo (?), dal nome del parametro e dal segno di uguale (=). Ad esempio, ?page=3 potrebbe indicare la terza pagina di una serie paginata.
Usa lo step Regole dei parametri dell'URL per specificare i parametri utilizzati dal tuo sito in modo che Site Audit possa eliminarli dagli URL durante la scansione. Non facendolo, un crawler che si imbatta in 2 versioni di una pagina, una con un parametro e una senza, potrebbe scansionarle entrambe, sprecando il tuo budget di scansione.
Inserisci ogni parametro in Parametri da ignorare.

Ad esempio, inserendo page vengono rimossi tutti i valori di quel parametro: ?page=1, ?page=2 e così via. Site Audit considera quindi /shoes e /shoes/?page=1 come un singolo URL e scansiona la pagina una sola volta.
I parametri comuni includono la paginazione, la lingua e le sottocategorie. Questi sono particolarmente comuni sui siti con grandi cataloghi di prodotti o contenuti. Un altro caso frequente è quello dei parametri UTM, utilizzati per tracciare i clic e il traffico delle campagne di marketing.
Per modificare queste impostazioni su una campagna esistente, apri l'icona delle impostazioni e seleziona Impostazioni dell'audit, quindi regola le stesse opzioni descritte sopra.

Restrizioni da aggirare
Per analizzare un sito web in pre-produzione o nascosto da un'autenticazione di accesso di base, hai tre opzioni.

Ignora le regole disallow all'interno di robots.txt e il tag meta robots
Carica il file .txt fornito da Semrush nella cartella principale del tuo sito. In questo modo verificherai la proprietà e permetterai a SiteAuditBot di scansionare le pagine bloccate da una direttiva di non consentito nel file robots.txt o da un meta tag robots nella sezione
.Scansiona con le mie credenziali
Inserisci il nome utente e la password che usi per accedere alla sezione nascosta del tuo sito. SiteAuditBot utilizzerà queste credenziali per accedere alle aree protette da password. Questa opzione è consigliata per i siti web non pubblici o in fase di sviluppo.
Scansione con firma Web Bot Auth
Alcune piattaforme di hosting, come Shopify, bloccano i bot sconosciuti per motivi di sicurezza o di prestazioni. Una firma Web Bot Auth consente a SiteAuditBot di identificarsi e di dimostrare di essere autorizzato ad accedere al tuo sito web. Per configurarla:
- Seleziona la casella di controllo Scansione con firma Web Bot Auth
- In Agente firma, inserisci l'URL dell'agente: ad esempio, "https://shopify.com
- In Input firma, inserisci la stringa di input richiesta dal tuo host
- In Firma, inserisci la firma criptata fornita dalla tua piattaforma
Risoluzione dei problemi
Se vedi l'errore L'audit del dominio non è andato a buon fine, probabilmente il tuo server sta bloccando SiteAuditBot. Segui i passaggi per la risoluzione dei problemi di Site Audit per includere il bot nella lista bianca.
Puoi anche scaricare il file di log generato quando un crawl fallisce e inviarlo al tuo webmaster, che potrà usarlo per identificare il motivo per cui SiteAuditBot è bloccato.
Collega Google Analytics e Site Audit
Una volta completata la procedura guidata, potrai collegare il tuo account Google Analytics per individuare i problemi che riguardano le tue pagine più visitate.