Skip to content
Zweryfikowany przewodnik Wavize

Analiza strony i jej mapy witryny

Importuj porządnie użyte strony publiczne, unikając obszarów technicznych lub prywatnych.

Zaktualizowano 7 sierpnia 2026

Co crawl importuje — a co powinien pominąć

Źródło „Pełna strona internetowa” eksploruje publiczne strony tej samej domeny, aby wyciągnąć tekst do wykorzystania przez asystenta. Uzupełnia to lekką analizę z onboardingu: ta przygotowuje profil, a crawl buduje bazę indywidualnie śledzonych stron.

Dozwolony wolumen zależy od planu i miesięcznego limitu URL. Wavize odkrywa adresy, umieszcza je w kolejce, przetwarza w tle i pokazuje liczby odkrytych, udanych, wykluczonych i nieudanych. Duża mapa witryny nie niweluje limitu Twojego planu.

Zakres bezpieczeństwa
Używaj tylko publicznych stron, do których Twoja firma ma prawo. Wavize blokuje destynacje prywatne lub niebezpieczne i nie obejmuje połączenia, zapory czy wyzwań antybot.

Tworzenie pełnego źródła witryny

W Bazie wiedzy wybierz Pełna strona internetowa, nadaj rozpoznawalny tytuł i wpisz kanoniczny adres URL.

  1. Wybór korzenia publicznego

    Preferuj https://exemple.com lub jego końcową wariantę www. Unikaj adresów koszyka, tymczasowych kampanii, prywatnych subdomen lub przekierowań poza domenę.

  2. Pozostaw włączone „Trenuj teraz”

    Pole jest domyślnie zaznaczone. Prosi Wavize o rozpoczęcie odkrywania i indeksowania po zapisaniu. Odznacz tylko, jeśli chcesz przygotować źródło bez uruchamiania.

  3. Czekaj na kolejkę przetwarzania

    Nie odświeżaj i nie twórz ponownie źródła. Status przechodzi przez stany kolejki i przetwarzania; postęp aktualizuje się wraz z wykonywaniem zadań w tle.

Zrozumienie odkrywania, mapy witryny i selekcji

Wavize może korzystać z map witryny i przeglądać linki wewnętrzne, zachowując zabezpieczenia i priorytety.

  • Strony o wysokiej wartości

    Strona główna, usługi, kategorie, produkty, pomoc, dostawa, zwroty i kontakt mają zwykle wyższy priorytet. Strona powinna zawierać użyteczny tekst, nie tylko animację lub bloki ładowane po interakcji.

  • Adresy techniczne

    Wyłącz konto, logowanie, koszyk, płatności, wyszukiwarkę, ustawienia śledzenia, podglądy i nieskończone filtry. Tworzą duplikaty lub pokazują puste ekrany bez wartości dla odpowiedzi.

  • Limit i selekcja częściowa

    Jeśli odkrywanie przekracza limit, skup się na najważniejszych stronach lub wyklucz grupy URL. Absolutny limit bezpieczeństwa nie gwarantuje importu wszystkich adresów z ogromnej strony.

Zarządzanie URL po pierwszym crawlu

Profil źródła pozwala wyszukiwać odkryte strony, trwale je wykluczać, przywracać i ponownie uruchamiać trening.

  1. Wykluczanie bez utraty kontroli

    Trwałe wykluczenie zapobiega powrotowi strony przy następnym crawlu. Zanotuj powód w procedurze wewnętrznej, szczególnie ze względu na politykę lub lokalne przepisy.

  2. Przywracanie i ponowny trening

    Przywrócenie adresu URL czyni go ponownie kwalifikowalnym; uruchom trening i poczekaj na przetworzenie przed testem informacji zawartej na stronie.

  3. Ostrożna interpretacja niepowodzeń

    Tabela pokazuje łączną liczbę nieudanych stron, ale nie zapewnia szczegółowej diagnozy dla każdej strony. Przetestuj stronę publicznie, sprawdź przekierowania, status HTTP, zaporę i zawartość zanim skontaktujesz się z wsparciem.


Kontrola jakości crawla

Crawl jest użyteczny tylko, gdy zakres odpowiada wiedzy, jaką ma posiadać asystent.

  • Pokrycie — Znajdź na liście priorytetowe strony sprzedażowe i wsparcia.
  • Czystość — Żaden koszyk, konto lub masowy wariant filtra nie dominuje wyników.
  • Przetestowana odpowiedź — Pytanie odnosi się do wyraźnego faktu ze strony, bez dodawania informacji wymyślonych.

Nie znalazłeś odpowiedzi?

Nasz zespół pomoże Ci w Twoim panelu klienta.

Skontaktuj się z pomocą techniczną