Najczęstsze pojęcia techniczne SEO wyjaśnione prosto

Ten artykuł rozwija temat z: Słowniczek pojęć SEO: Definicje i znaczenia
Techniczne SEO bywa postrzegane jako skomplikowana dziedzina zarezerwowana dla programistów. W rzeczywistości jego fundamenty są logiczne i zrozumiałe dla każdego, kto chce, by jego strona internetowa była widoczna w Google. Możesz tworzyć najlepsze na świecie treści i mieć piękną szatę graficzną, ale jeśli "silnik" Twojej strony szwankuje, nikt do niej nie dotrze.
Ten artykuł to prosty słownik najważniejszych pojęć technicznego SEO. Każde z nich wyjaśniamy na trzy sposoby: przez techniczną definicję, proste wytłumaczenie i obrazową analogię z życia codziennego.
Więcej o tym przeczytasz w: Podstawowe pojęcia SEO - słownik dla początkujących
Jak Google odkrywa Twoją stronę
Zanim Twoja strona pojawi się w wynikach wyszukiwania, musi przejść dwa kluczowe etapy. Bez nich, dla Google po prostu nie istniejesz.
Crawlowanie (skanowanie)
Definicja techniczna: Crawlowanie (ang. crawling) to proces, w którym roboty wyszukiwarek, takie jak Googlebot, odwiedzają strony internetowe, podążając za linkami, aby odkryć nowe i zaktualizowane treści.
Proste wyjaśnienie: To pierwszy kontakt Google z Twoją stroną. Specjalny program automatycznie "przegląda" Twoją witrynę, przeskakując z jednej podstrony na drugą za pomocą linków, tak jak człowiek klika w odnośniki.
Analogia: Wyobraź sobie bibliotekarza, który po raz pierwszy wchodzi do nowej biblioteki. Chodzi między wszystkimi regałami i alejkami, żeby zobaczyć, jakie książki w ogóle się tam znajdują. Jeszcze ich nie czyta, tylko tworzy listę tego, co jest dostępne.
Indeksowanie
Definicja techniczna: Indeksowanie (ang. indexing) to proces analizowania i zapisywania treści ze zmapowanych stron w ogromnej bazie danych Google, zwanej indeksem.
Proste wyjaśnienie: Po tym, jak Googlebot odkryje Twoje podstrony, Google analizuje ich zawartość (tekst, obrazy, filmy) i dodaje je do swojego gigantycznego katalogu. Strona niezaindeksowana nie pojawi się w wynikach wyszukiwania, nawet jeśli wpiszesz jej adres idealnie.
Analogia: Bibliotekarz, który stworzył już listę książek (crawlowanie), teraz bierze każdą z nich, czyta okładkę, spis treści i krótki opis, a następnie dodaje ją do oficjalnego katalogu bibliotecznego pod odpowiednimi kategoriami. Dopiero gdy książka jest w katalogu, czytelnicy mogą ją znaleźć i wypożyczyć.
Więcej o tym przeczytasz w: Skróty SEO: SERP, CTR, CTA i Backlink - O co chodzi?
Jak sterować robotami Google
Możesz i powinieneś dawać robotom Google wskazówki, jak mają poruszać się po Twojej stronie. Służą do tego specjalne narzędzia.
robots.txt
Definicja techniczna: Plik tekstowy umieszczony w głównym katalogu strony, który zawiera dyrektywy dla robotów wyszukiwarek, wskazując, których zasobów nie powinny one skanować.
Proste wyjaśnienie: To najprostsza instrukcja dla Googlebota. Mówisz mu: "Tej części strony, proszę, nie odwiedzaj". Najczęściej blokuje się dostęp do panelu logowania, koszyka zakupowego czy wewnętrznych wyników wyszukiwania, które nie wnoszą wartości dla użytkowników z zewnątrz.
Analogia: To tabliczka z napisem "Wstęp tylko dla personelu" na drzwiach zaplecza w sklepie. Klienci wiedzą, że nie powinni tam wchodzić, a personel wie, że to strefa robocza.
Przykład prostego pliku robots.txt:
User-agent: *
Disallow: /panel-logowania/
Disallow: /koszyk/
Mapa witryny (sitemap.xml)
Definicja techniczna: Plik w formacie XML (ang. Sitemap.xml), który zawiera listę wszystkich ważnych adresów URL w obrębie witryny, które chcesz udostępnić do indeksowania.
Proste wyjaśnienie: Zamiast czekać, aż Googlebot sam znajdzie wszystkie Twoje podstrony, podajesz mu gotową listę na tacy. To znacznie przyspiesza proces odkrywania nowych treści, zwłaszcza w dużych serwisach.
Analogia: To dokładna mapa centrum handlowego z listą wszystkich sklepów, którą dostajesz przy wejściu. Nie musisz błądzić po korytarzach, żeby odkryć, co gdzie jest - masz gotowy przewodnik.
Tag kanoniczny (rel="canonical")
Definicja techniczna: Atrybut HTML (<link rel="canonical" ...>), który wskazuje wyszukiwarkom preferowaną (główną) wersję adresu URL w przypadku, gdy ta sama lub bardzo podobna treść jest dostępna pod kilkoma różnymi adresami.
Proste wyjaśnienie: Czasami ten sam produkt w sklepie internetowym może mieć kilka adresów (np. przez filtry, sortowanie, kolory). Aby Google nie traktowało tego jako powielonej treści (ang. duplicate content), tag kanoniczny wskazuje, który adres jest tym "oryginalnym".
Analogia: Masz w ofercie jedną czerwoną sukienkę. Jest dostępna pod adresem /sukienki/czerwona-sukienka, ale też /promocje/czerwona-sukienka i /nowosci/czerwona-sukienka. Tag kanoniczny na wszystkich tych stronach mówi Google: "Hej, to wszystko jest tą samą sukienką, ale za oryginał uważaj ten pierwszy adres".
Przykład tagu kanonicznego w kodzie strony:
<link rel="canonical" href="https://www.przyklad.pl/glowna-wersja-strony" />
Kody odpowiedzi serwera - przekierowania i błędy
Gdy Twoja przeglądarka lub Googlebot prosi serwer o stronę, serwer odpowiada specjalnym kodem statusu HTTP. Trzy z nich są kluczowe dla SEO.
Przekierowanie 301 (stałe)
Definicja techniczna: Kod statusu HTTP informujący, że zasób został trwale przeniesiony pod nowy adres URL.
Proste wyjaśnienie: Używasz go, gdy na stałe zmieniasz adres podstrony. Przekierowanie 301 mówi Google, żeby zaktualizowało swój indeks i przekazało większość "mocy" SEO ze starego adresu na nowy.
Analogia: To trwała przeprowadzka. Zmieniasz adres zamieszkania, zgłaszasz to na poczcie i wszystkie listy automatycznie trafiają na nowy adres. Na starych drzwiach zostawiasz kartkę z informacją, gdzie teraz mieszkasz.
Przekierowanie 302 (tymczasowe)
Definicja techniczna: Kod statusu HTTP informujący, że zasób został tymczasowo przeniesiony pod inny adres.
Proste wyjaśnienie: Stosujesz je, gdy strona jest niedostępna tylko przez krótki czas (np. z powodu prac technicznych) i chcesz skierować użytkowników gdzie indziej, ale z zamiarem powrotu do starego adresu. Google wie, by nie usuwać starego adresu z indeksu.
Analogia: To krótki remont mieszkania. Na drzwiach wieszasz kartkę "Chwilowo zapraszamy do sąsiada", ale wszyscy wiedzą, że za kilka dni wrócisz pod stary adres.
Błąd 404 (Page Not Found)
Definicja techniczna: Kod statusu HTTP oznaczający, że serwer nie mógł odnaleźć żądanego zasobu.
Proste wyjaśnienie: Błąd 404 pojawia się, gdy użytkownik lub robot próbuje wejść na stronę, która nie istnieje - została usunięta lub adres URL zawiera literówkę. To ślepy zaułek, który psuje doświadczenie użytkownika.
Analogia: To pusta półka w sklepie, na której kiedyś stał Twój ulubiony produkt. Przychodzisz, szukasz, ale go nie ma. Czujesz się zdezorientowany i lekko zirytowany.
Jak pomóc Google zrozumieć treść
Google jest coraz mądrzejsze, ale nadal jest maszyną. Możesz mu pomóc zrozumieć kontekst Twoich treści za pomocą specjalnych znaczników.
Dane strukturyzowane (Schema.org)
Definicja techniczna: Ustandaryzowany format (słownictwo Schema.org) dodawania do kodu strony dodatkowych informacji, które opisują jej zawartość w sposób zrozumiały dla maszyn.
Proste wyjaśnienie: To zestaw "etykiet", którymi opisujesz elementy na swojej stronie. Mówisz Google: "To jest przepis kulinarny, to jest ocena w gwiazdkach, to jest cena produktu, a to data wydarzenia". Dzięki temu Google może wyświetlać w wynikach wyszukiwania dodatkowe, rozszerzone informacje, tzw. Rich Snippets.
Analogia: To jak dodawanie szczegółowych notatek na marginesie książki dla bibliotekarza. Podkreślasz kluczowe fragmenty i dopisujesz: "To jest główny bohater", "Tu jest punkt zwrotny akcji", "To jest data publikacji". Google, widząc te notatki, może lepiej zaprezentować Twoją książkę w katalogu. Najczęściej stosowanym formatem rekomendowanym przez Google jest JSON-LD.
Szybkość i stabilność strony - Core Web Vitals
Core Web Vitals (CWV) to zestaw trzech konkretnych wskaźników, którymi Google mierzy doświadczenie użytkownika (UX) na stronie. Mają one bezpośredni wpływ na ranking.
LCP (Largest Contentful Paint)
Definicja techniczna: Mierzy postrzeganą szybkość ładowania. Oznacza czas od rozpoczęcia ładowania strony do momentu wyrenderowania największego bloku tekstowego lub elementu graficznego w widocznym obszarze.
Proste wyjaśnienie: Jak szybko na ekranie pojawia się główna, najważniejsza treść strony (np. baner, zdjęcie produktu, pierwszy akapit artykułu)? Dobry wynik LCP to 2,5 sekundy lub mniej.
INP (Interaction to Next Paint)
Definicja techniczna: Mierzy ogólną responsywność strony na interakcje użytkownika. Rejestruje opóźnienie wszystkich kliknięć, dotknięć i interakcji z klawiaturą, które występują w trakcie wizyty na stronie.
Proste wyjaśnienie: Jak szybko strona reaguje, gdy coś na niej klikniesz? Czy menu rozwija się od razu, czy z opóźnieniem? Od 12 marca 2024 roku INP oficjalnie zastąpiło wskaźnik FID (First Input Delay) jako miara responsywności. Dobry wynik INP to 200 milisekund lub mniej.
CLS (Cumulative Layout Shift)
Definicja techniczna: Mierzy stabilność wizualną. Określa, jak bardzo elementy strony niespodziewanie przesuwają się podczas jej ładowania.
Proste wyjaśnienie: Czy zdarzyło Ci się, że chciałeś kliknąć link, ale w ostatniej chwili nad nim załadowała się reklama, powodując przesunięcie układu i kliknięcie w baner? CLS mierzy właśnie takie irytujące "skoki" treści. Dobry wynik CLS to 0,1 lub mniej.
Analogia dla CLS: To jak próba naciśnięcia przycisku w windzie, który w ostatniej chwili przesuwa się w inne miejsce, bo cały panel się poruszył.
Efektywność i wielojęzyczność
Na koniec dwa pojęcia, które nabierają znaczenia w przypadku dużych lub międzynarodowych serwisów.
Budżet crawlingu (Crawl Budget)
Definicja techniczna: Ograniczona liczba zasobów i czasu, jakie Googlebot może poświęcić na skanowanie danej witryny.
Proste wyjaśnienie: Google nie może skanować wszystkich stron internetowych bez przerwy. Każdej witrynie przydziela pewien "budżet" - czyli czas i zasoby. Jeśli masz ogromny serwis (np. powyżej 10 000 podstron), musisz zadbać o to, by robot nie marnował tego budżetu na nieistotne strony.
Analogia: Masz bilet czasowy na zwiedzanie ogromnego muzeum. Jeśli spędzisz cały czas w szatni i korytarzach, nie zdążysz zobaczyć najważniejszych eksponatów. Musisz mieć plan, by efektywnie wykorzystać swój czas.
Atrybut hreflang
Definicja techniczna: Atrybut HTML używany do informowania wyszukiwarek o istnieniu różnych wersji językowych lub regionalnych tej samej strony.
Proste wyjaśnienie: Jeśli prowadzisz stronę w kilku językach (np. polskim i angielskim), atrybut hreflang mówi Google: "Ta podstrona jest dla użytkowników z Polski mówiących po polsku, a pod tym drugim linkiem znajdziesz jej odpowiednik dla użytkowników z USA mówiących po angielsku".
Analogia: To system informacyjny na międzynarodowym lotnisku. Tabliczki i komunikaty kierują pasażerów do odpowiednich bramek i stanowisk w zależności od tego, jakim językiem się posługują i dokąd lecą.
Podsumowanie
Zrozumienie tych jedenastu pojęć to solidny fundament pod dalszą naukę technicznego SEO. Pamiętaj, że celem nie jest zostanie programistą, ale upewnienie się, że "silnik" Twojej strony działa sprawnie i nie blokuje drogi do Twoich treści ani użytkownikom, ani robotom Google.
Co robić dalej? Prosta checklista na start:
- Upewnij się, że masz skonfigurowane darmowe narzędzie Google Search Console - to centrum diagnostyczne Twojej strony.
- Wygeneruj i prześlij w nim mapę witryny (sitemap.xml).
- Sprawdź w Google Search Console raport "Podstawowe wskaźniki internetowe", by zobaczyć, jak Twoja strona wypada w teście Core Web Vitals.
- Użyj narzędzia "Sprawdź URL" dla kilku najważniejszych podstron, by potwierdzić, że są poprawnie zaindeksowane.