Correggere un errore di crawl o sincronizzazione
Identifica se il problema deriva dall’URL, dal server remoto, dal contenuto o da una limitazione temporanea.
Aggiornato il 7 agosto 2026Un errore di crawl può verificarsi prima, durante o dopo il download
Prima: URL non valida, destinazione privata o quota superata. Durante: DNS, TLS, redirect, stato HTTP, challenge o dimensione. Dopo: contenuto vuoto, formato non utilizzabile, estrazione o attività di indicizzazione. Identificare la fase evita di rilanciare l’intero database.
Per un sito completo, Wavize mostra totali di pagine scoperte, processate e fallite, ma non sempre conserva un motivo dettagliato per ogni URL. Isola una pagina rappresentativa per avere una diagnosi riproducibile.
Rilancio mirato
Correggi prima la causa, rilancia alcune URL prioritarie, poi l’intero sito. Rilanci ripetuti consumano quota e possono nascondere l’ora del primo incidente.
Testa l’URL come visitatore anonimo
Usa una finestra in incognito e, se possibile, una rete esterna.
Risposta senza login
La pagina deve mostrare il contenuto senza account, password, cookie precedenti o token temporaneo firmato.
Redirect completati
Controlla l’URL finale, lo stesso dominio e l’assenza di loop HTTP/HTTPS o www. L’analisi onboarding limita i redirect e un crawl rispetta i controlli di destinazione.
Testo realmente presente
Pagina vuota prima di eseguire JavaScript, solo video o canvas non forniscono contenuto utilizzabile. Aggiungi versione HTML o testuale.
Leggi le risposte server
Chiedi all’hosting i log dell’ora del test se necessario.
403 o challenge
Il WAF, robots o protezione anti-bot blocca il server. Crea regole mirate secondo la politica senza disattivare la sicurezza completa.
404 o 410
Correggi link e sitemap, escludi pagine rimosse e non sostituirle con redirect alla homepage per evitare contenuto duplicato.
429
Il server limita le richieste. Distanza i crawl o regola le impostazioni per Wavize; non avviare fonti identiche in parallelo.
5xx / TLS / DNS
Correggi indisponibilità, catena certificato o risoluzione prima del rilancio. Una pagina accessibile solo dalla tua postazione può rimanere irraggiungibile pubblicamente.
Controlla quota, selezione e stato del task
Una fonte parziale non è sempre un guasto.
Quota mensile URL
Confronta pagine usate e capacità del piano. Escludi filtri, parametri o duplicati prima del rilancio.
Coda e worker
Uno stato queued persistente può indicare coda piena o worker fermo. Segnala durata e fonte prima di aprire ticket.
Errori concentrati
Cerca pattern comuni di URL: lingua, sottodominio, filtro, file pesante. Escludere famiglie può salvare il crawl utile.
Validare la correzione nelle risposte
Uno stato riuscito deve produrre dati utili.
Pagina processata
La pagina prioritaria non è più fallita o esclusa per errore.
Domanda fattuale
Fai una domanda con risposta esplicita nel contenuto scaricato.
Assenza di duplicati
La vecchia URL o versione non offre risposte contrastanti dopo l’aggiornamento.
Informazioni per supporto
Non inviare API key o pagine private.
- Fonte — Titolo, tipo e URL pubblica.
- Cronologia — Ora avvio, durata in ogni stato e ultimo rilancio.
- Campione — Due o tre URL rappresentative con stato pubblico.
Non hai trovato la risposta?
Il nostro team può aiutarti dal tuo spazio cliente.