Analiza strony i jej mapy witryny
Importuj porządnie użyte strony publiczne, unikając obszarów technicznych lub prywatnych.
Zaktualizowano 7 sierpnia 2026Co crawl importuje — a co powinien pominąć
Źródło „Pełna strona internetowa” eksploruje publiczne strony tej samej domeny, aby wyciągnąć tekst do wykorzystania przez asystenta. Uzupełnia to lekką analizę z onboardingu: ta przygotowuje profil, a crawl buduje bazę indywidualnie śledzonych stron.
Dozwolony wolumen zależy od planu i miesięcznego limitu URL. Wavize odkrywa adresy, umieszcza je w kolejce, przetwarza w tle i pokazuje liczby odkrytych, udanych, wykluczonych i nieudanych. Duża mapa witryny nie niweluje limitu Twojego planu.
Zakres bezpieczeństwa
Używaj tylko publicznych stron, do których Twoja firma ma prawo. Wavize blokuje destynacje prywatne lub niebezpieczne i nie obejmuje połączenia, zapory czy wyzwań antybot.
Tworzenie pełnego źródła witryny
W Bazie wiedzy wybierz Pełna strona internetowa, nadaj rozpoznawalny tytuł i wpisz kanoniczny adres URL.
Wybór korzenia publicznego
Preferuj https://exemple.com lub jego końcową wariantę www. Unikaj adresów koszyka, tymczasowych kampanii, prywatnych subdomen lub przekierowań poza domenę.
Pozostaw włączone „Trenuj teraz”
Pole jest domyślnie zaznaczone. Prosi Wavize o rozpoczęcie odkrywania i indeksowania po zapisaniu. Odznacz tylko, jeśli chcesz przygotować źródło bez uruchamiania.
Czekaj na kolejkę przetwarzania
Nie odświeżaj i nie twórz ponownie źródła. Status przechodzi przez stany kolejki i przetwarzania; postęp aktualizuje się wraz z wykonywaniem zadań w tle.
Zrozumienie odkrywania, mapy witryny i selekcji
Wavize może korzystać z map witryny i przeglądać linki wewnętrzne, zachowując zabezpieczenia i priorytety.
Strony o wysokiej wartości
Strona główna, usługi, kategorie, produkty, pomoc, dostawa, zwroty i kontakt mają zwykle wyższy priorytet. Strona powinna zawierać użyteczny tekst, nie tylko animację lub bloki ładowane po interakcji.
Adresy techniczne
Wyłącz konto, logowanie, koszyk, płatności, wyszukiwarkę, ustawienia śledzenia, podglądy i nieskończone filtry. Tworzą duplikaty lub pokazują puste ekrany bez wartości dla odpowiedzi.
Limit i selekcja częściowa
Jeśli odkrywanie przekracza limit, skup się na najważniejszych stronach lub wyklucz grupy URL. Absolutny limit bezpieczeństwa nie gwarantuje importu wszystkich adresów z ogromnej strony.
Zarządzanie URL po pierwszym crawlu
Profil źródła pozwala wyszukiwać odkryte strony, trwale je wykluczać, przywracać i ponownie uruchamiać trening.
Wykluczanie bez utraty kontroli
Trwałe wykluczenie zapobiega powrotowi strony przy następnym crawlu. Zanotuj powód w procedurze wewnętrznej, szczególnie ze względu na politykę lub lokalne przepisy.
Przywracanie i ponowny trening
Przywrócenie adresu URL czyni go ponownie kwalifikowalnym; uruchom trening i poczekaj na przetworzenie przed testem informacji zawartej na stronie.
Ostrożna interpretacja niepowodzeń
Tabela pokazuje łączną liczbę nieudanych stron, ale nie zapewnia szczegółowej diagnozy dla każdej strony. Przetestuj stronę publicznie, sprawdź przekierowania, status HTTP, zaporę i zawartość zanim skontaktujesz się z wsparciem.
Kontrola jakości crawla
Crawl jest użyteczny tylko, gdy zakres odpowiada wiedzy, jaką ma posiadać asystent.
- Pokrycie — Znajdź na liście priorytetowe strony sprzedażowe i wsparcia.
- Czystość — Żaden koszyk, konto lub masowy wariant filtra nie dominuje wyników.
- Przetestowana odpowiedź — Pytanie odnosi się do wyraźnego faktu ze strony, bez dodawania informacji wymyślonych.
Nie znalazłeś odpowiedzi?
Nasz zespół pomoże Ci w Twoim panelu klienta.