Skip to content
Geverifieerde Wavize-handleiding

Een site en de sitemap analyseren

Importeer netjes nuttige publieke pagina's zonder technische of privégebieden te indexeren.

Bijgewerkt op 7 augustus 2026

Wat de crawl importeert — en wat genegeerd moet worden

De bron “Volledige website” doorzoekt publieke pagina’s van hetzelfde domein om bruikbare tekstuele inhoud voor de assistent te extraheren. Dit vult de lichte onboarding-analyse aan: die bereidt het profiel voor, terwijl de crawl een basis bouwt van individueel gevolgde pagina’s.

Het toegestane volume hangt af van het abonnement en het maandelijkse URL-quota. Wavize ontdekt adressen, plaatst ze in een wachtrij, verwerkt ze op de achtergrond en toont de aantallen ontdekt, succesvol, uitgesloten en mislukt. Een grote sitemap heft de limiet van uw abonnement niet op.

Veiligheidsgebied
Gebruik alleen publieke pagina’s die uw bedrijf mag exploiteren. Wavize blokkeert privé- of gevaarlijke bestemmingen en mag geen verbindingen, firewalls of anti-robot uitdagingen omzeilen.

Een bron voor volledige site aanmaken

Kies bij Kennisbasis voor Volledige website, geef een herkenbare titel en voer de canonieke URL in.

  1. Kies de publieke root

    Bij voorkeur https://exemple.com of de bijbehorende www-variant. Vermijd een winkelwagen-URL, tijdelijke campagne, privé-subdomein of een domein-verlatende redirect.

  2. Laat ‘Nu trainen’ ingeschakeld

    Het vakje staat standaard aan. Dit vraagt Wavize de ontdekking en indexering na opslaan te starten. Zet het uit als u de bron wilt voorbereiden zonder uit te voeren.

  3. Wacht op verwerkingswachtrij

    Ververs niet herhaaldelijk en maak de bron niet opnieuw aan. De status verloopt via wachtrij- en verwerkingsstadia; de voortgang groeit met de achtergrondtaken mee.

Begrijp ontdekking, sitemap en selectie

Wavize kan sitemaps gebruiken en interne links crawlen, maar behoudt bescherming en prioriteiten.

  • Pagina’s met hoge waarde

    Home, diensten, categorieën, producten, help, verzending, retour en contact zijn meestal prioritair. Een pagina moet nuttige tekst bevatten, niet alleen een animatie of blokken die na interactie laden.

  • Technische URL’s

    Sluit account, login, winkelwagen, betaling, interne zoekopdracht, tracking-instellingen, previews en oneindige filters uit. Deze veroorzaken duplicaten of tonen schermen zonder waarde voor een antwoord.

  • Quota en gedeeltelijke selectie

    Als de ontdekking de capaciteit overschrijdt, focus dan op de meest nuttige pagina’s of sluit URL-families uit. De absolute veiligheidslimiet garandeert nooit dat alle URL’s van een enorme site worden geïmporteerd.

URL’s aansturen na eerste crawl

De bronfiche laat zoeken naar ontdekte pagina’s toe, ze duurzaam uitsluiten, herstellen en training opnieuw starten.

  1. Uitsluiten zonder controleverlies

    Een blijvende uitsluiting voorkomt terugkeer bij volgende crawl. Noteer de reden in uw interne procedure, vooral bij oude beleidslijnen of lokale juridische zones.

  2. Herstellen en opnieuw trainen

    Een URL herstellen maakt deze herbruikbaar; start daarna training opnieuw en wacht de verwerking af voordat u informatie test.

  3. Wees voorzichtig met falen

    De tabel toont totaal mislukte pagina’s maar belooft geen gedetailleerde diagnose per URL. Test de pagina openbaar, controleer redirects, HTTP-status, firewall en inhoud voordat u support benadert.


Kwaliteitscontrole van een crawl

Een voltooide crawl is alleen nuttig als het bereik overeenkomt met wat de assistent moet kennen.

  • Dekking — Zoek de prioritaire commerciële en ondersteuningspagina’s in de lijst.
  • Zuiverheid — Geen enkele winkelwagen, account of massale filtervariant domineert de resultaten.
  • Getest antwoord — Een vraag herhaalt een expliciet feit van de behandelde pagina, zonder verzonnen toevoegingen.

Antwoord niet gevonden?

Ons team helpt u graag vanuit uw klantenruimte.

Contact opnemen met ondersteuning