Een site en de sitemap analyseren
Importeer netjes nuttige publieke pagina's zonder technische of privégebieden te indexeren.
Bijgewerkt op 7 augustus 2026Wat de crawl importeert — en wat genegeerd moet worden
De bron “Volledige website” doorzoekt publieke pagina’s van hetzelfde domein om bruikbare tekstuele inhoud voor de assistent te extraheren. Dit vult de lichte onboarding-analyse aan: die bereidt het profiel voor, terwijl de crawl een basis bouwt van individueel gevolgde pagina’s.
Het toegestane volume hangt af van het abonnement en het maandelijkse URL-quota. Wavize ontdekt adressen, plaatst ze in een wachtrij, verwerkt ze op de achtergrond en toont de aantallen ontdekt, succesvol, uitgesloten en mislukt. Een grote sitemap heft de limiet van uw abonnement niet op.
Veiligheidsgebied
Gebruik alleen publieke pagina’s die uw bedrijf mag exploiteren. Wavize blokkeert privé- of gevaarlijke bestemmingen en mag geen verbindingen, firewalls of anti-robot uitdagingen omzeilen.
Een bron voor volledige site aanmaken
Kies bij Kennisbasis voor Volledige website, geef een herkenbare titel en voer de canonieke URL in.
Kies de publieke root
Bij voorkeur https://exemple.com of de bijbehorende www-variant. Vermijd een winkelwagen-URL, tijdelijke campagne, privé-subdomein of een domein-verlatende redirect.
Laat ‘Nu trainen’ ingeschakeld
Het vakje staat standaard aan. Dit vraagt Wavize de ontdekking en indexering na opslaan te starten. Zet het uit als u de bron wilt voorbereiden zonder uit te voeren.
Wacht op verwerkingswachtrij
Ververs niet herhaaldelijk en maak de bron niet opnieuw aan. De status verloopt via wachtrij- en verwerkingsstadia; de voortgang groeit met de achtergrondtaken mee.
Begrijp ontdekking, sitemap en selectie
Wavize kan sitemaps gebruiken en interne links crawlen, maar behoudt bescherming en prioriteiten.
Pagina’s met hoge waarde
Home, diensten, categorieën, producten, help, verzending, retour en contact zijn meestal prioritair. Een pagina moet nuttige tekst bevatten, niet alleen een animatie of blokken die na interactie laden.
Technische URL’s
Sluit account, login, winkelwagen, betaling, interne zoekopdracht, tracking-instellingen, previews en oneindige filters uit. Deze veroorzaken duplicaten of tonen schermen zonder waarde voor een antwoord.
Quota en gedeeltelijke selectie
Als de ontdekking de capaciteit overschrijdt, focus dan op de meest nuttige pagina’s of sluit URL-families uit. De absolute veiligheidslimiet garandeert nooit dat alle URL’s van een enorme site worden geïmporteerd.
URL’s aansturen na eerste crawl
De bronfiche laat zoeken naar ontdekte pagina’s toe, ze duurzaam uitsluiten, herstellen en training opnieuw starten.
Uitsluiten zonder controleverlies
Een blijvende uitsluiting voorkomt terugkeer bij volgende crawl. Noteer de reden in uw interne procedure, vooral bij oude beleidslijnen of lokale juridische zones.
Herstellen en opnieuw trainen
Een URL herstellen maakt deze herbruikbaar; start daarna training opnieuw en wacht de verwerking af voordat u informatie test.
Wees voorzichtig met falen
De tabel toont totaal mislukte pagina’s maar belooft geen gedetailleerde diagnose per URL. Test de pagina openbaar, controleer redirects, HTTP-status, firewall en inhoud voordat u support benadert.
Kwaliteitscontrole van een crawl
Een voltooide crawl is alleen nuttig als het bereik overeenkomt met wat de assistent moet kennen.
- Dekking — Zoek de prioritaire commerciële en ondersteuningspagina’s in de lijst.
- Zuiverheid — Geen enkele winkelwagen, account of massale filtervariant domineert de resultaten.
- Getest antwoord — Een vraag herhaalt een expliciet feit van de behandelde pagina, zonder verzonnen toevoegingen.
Antwoord niet gevonden?
Ons team helpt u graag vanuit uw klantenruimte.