Wyszukiwarka nie ocenia domeny binarnie: „ekspert” albo „nie ekspert”. Buduje profil tematyczny — historię interakcji użytkowników z treściami źródła w kontekście konkretnych tematów. Im dłuższa i silniejsza ta historia, tym wyższy autorytet tematyczny. Badanie Graphite z 2024 roku wykazało, że strony z wysokim autorytetem tematycznym zyskują ruch organiczny 57% szybciej niż strony z niskim autorytetem. Ale sam „autorytet tematyczny” to pojęcie wielowarstwowe — i większość poradników SEO spłaszcza je do jednej rady: „napisz więcej artykułów na temat”. W tym artykule rozkładam topical authority na czynniki pierwsze, opierając się na patentach Google, danych z wycieku dokumentacji API z 2024 roku i wynikach audytów diagnostycznych.
Czym topical authority nie jest — i dlaczego „więcej artykułów” nie wystarczy
Popularne uproszczenie: „napisz 20 artykułów na temat X i zbudujesz topical authority”. To nieprawda z punktu widzenia mechanizmów opisanych w patentach Google. Patent US8949228B2 („Identification of new sources for topics”, Google LLC, wynalazcy: Nissan Hajaj, Garrett Yaun) opisuje source-topic interaction — ocenę interakcji źródła z tematem na podstawie historii behawioralnej. Patent US8458196B1 („System and method for determining topic authority”) dodaje warstwę autorytetu autora. Żaden z tych patentów nie mierzy „liczby artykułów”. Mierzą coś zupełnie innego.
Mierzą: jak użytkownicy wchodzą w interakcję z treścią na dany temat (kliknięcia, CTR, czas na stronie), jak treści są ze sobą powiązane (linki wewnętrzne, wspólne encje, struktura tematyczna) i czy źródło dostarcza nową wartość informacyjną (information gain — unikalność treści w porównaniu z innymi dokumentami na ten sam temat). Domena z 50 artykułami o „SEO”, które powtarzają te same ogólniki, będzie miała niższy autorytet tematyczny niż domena z 8 pogłębionymi artykułami, które pokrywają unikalne podtematy, linkują do siebie kontekstowo i generują długie sesje użytkowników.
Dlaczego to rozróżnienie jest krytyczne? Bo prowadzi do zupełnie innej strategii. Zamiast „produkować więcej treści” — „pogłębiać istniejącą treść i budować powiązania”. Kevin Indig, były VP Growth w Shopify i G2, proponuje mierzenie topical authority jako Topic Share: udział ruchu organicznego, jaki domena generuje z zapytań związanych z konkretnym tematem, w stosunku do całego ruchu na te zapytania. Domena, która rankuje na 80% zapytań o „audyt SEO e-commerce” i generuje 35% kliknięć, ma silny Topic Share — nawet jeśli ma tylko 5 stron na ten temat.
Ramka metodologiczna. Analiza opiera się na patentach US8949228B2 (source-topic interaction) i US8458196B1 (topic authority). Scoringi autorytetu klastra to wskaźniki diagnostyczne Semgence oparte na danych GSC, GA4 i crawlu wewnętrznego. Nie są wynikami Google ani nie symulują opatentowanego algorytmu. Zgłoszenie patentowe nie jest dowodem wdrożenia w produkcyjnym algorytmie wyszukiwarki.
Co potwierdził wyciek dokumentacji API Google — siteFocusScore, siteRadius i site2vec
W maju 2024 roku zautomatyzowany bot opublikował na GitHubie tysiące stron wewnętrznej dokumentacji API Google Search. Wyciek ujawnił 2 596 modułów zawierających 14 014 atrybutów — najobszerniejszy widok na infrastrukturę rankingową Google, jaki kiedykolwiek został upubliczniony. Trzy atrybuty bezpośrednio potwierdzają, że Google mierzy specjalizację tematyczną domeny na poziomie algorytmicznym.
siteFocusScore — mierzy, jak bardzo domena jest skoncentrowana na określonym temacie. Wysoki siteFocusScore oznacza, że większość treści domeny dotyczy wąskiego zestawu tematów. Niska wartość wskazuje na „rozproszenie” — domena pisze o wszystkim, od przepisów kulinarnych po finanse osobiste. W praktyce: sklep z kawą specjalistyczną, który pisze wyłącznie o kawowych odmianach, metodach parzenia i sprzęcie, będzie miał wyższy siteFocusScore niż blog lifestyle’owy, który ma jedną kategorię „kawa” wśród dwudziestu innych.
siteRadius — mierzy, jak daleko poszczególne strony domeny odchylają się od jej głównego tematu. Techniczne określenie z dokumentacji: odległość strony od centroidu tematycznego domeny, mierzona wektorami site2vec. Strona „jak wybrać młynek do kawy” na portalu kawowym będzie miała niski siteRadius (blisko centroidu). Strona „najlepsze prezenty na Dzień Matki” na tym samym portalu — wysoki siteRadius (daleko od tematu głównego). Strony z wysokim siteRadius mogą osłabiać topical authority domeny, bo rozmywają sygnał tematyczny.
site2vecEmbeddingEncoded — skompresowana reprezentacja wektorowa tematu domeny. Google generuje embedding (wektor numeryczny) dla całej domeny na podstawie jej treści, a następnie porównuje embedding każdej strony z embeddingiem domeny. Im bliżej — tym silniejsze dopasowanie tematyczne. To algorytmiczna wersja pytania: „czy ta strona pasuje do tego, o czym zwykle pisze ta domena?”. Wszystkie te atrybuty znajdują się w module QualityNsrNsrData (Normalized Site Rank) — co potwierdza, że specjalizacja tematyczna wpływa na ocenę jakości domeny w rankingu.

9 warstw autorytetu tematycznego — co naprawdę mierzy audyt klastra
Autorytet tematyczny nie jest jednym score’em — to wypadkowa wielu niezależnych sygnałów, z których każdy odpowiada na inne pytanie. Poniższa tabela pokazuje 9 warstw, które diagnostyka klastra tematycznego ocenia, wraz z praktycznym wyjaśnieniem każdej z nich. Score’y to wskaźniki diagnostyczne Semgence — pokazują, które warstwy autorytetu są silne, a które wymagają uzupełnienia.
| Warstwa | Co mierzy — wyjaśnienie | Patent / źródło | Jak uzupełnić, gdy score jest niski |
|---|---|---|---|
| Popularność i zaangażowanie | Czy użytkownicy klikają w wyniki domeny na te tematy i czy spędzają tam czas? Kliknięcia z wyszukiwarki, CTR, bounce rate | US8949228B2 (source-topic interaction) | Poprawić meta title/description, skrócić odległość do odpowiedzi |
| Jakość widoczności w GSC | Jak domena performuje w Search Console na zapytania klastra: pozycje, CTR, trendy | Dane GSC | Optymalizować strony z niskim CTR przy dobrej pozycji |
| Zaangażowanie tematyczne | Czy popyt jest zróżnicowany (wiele zapytań) czy skoncentrowany na 1-2 frazach? Klaster z jednym zapytaniem to nie autorytet — to jedna strona | US8661029B1 (implicit user feedback) | Rozbudować klaster o podtematy widoczne w GSC |
| Zaufanie tematyczne | Czy domena ma sygnały wiarygodności w kontekście tematu: cytowania, linki z autorytatywnych źródeł, wzmianki w mediach branżowych | US7603350B1 (trust signals) | Zdobyć cytowania branżowe, dodać źródła do treści |
| Dopasowanie treści do zapytania | Czy treść faktycznie odpowiada na intencję zapytania? Strona o „audyt SEO cennik” powinna zawierać cennik, nie ogólny opis usługi | US8224827B2 (document classification ranking) | Audytować intencję: sprawdzić, czego szukają użytkownicy, i dopasować treść |
| Autorytet autora | Czy autor treści jest rozpoznawalny w temacie? Profil autora z bio, linkami do profili społecznościowych (sameAs), publikacjami | US8458196B1 (topic authority — author signature value) | Dodać pełny profil autora, sameAs, schema Person |
| Information gain (unikalność) | Czy strona dostarcza informację, której użytkownik nie znajdzie na innych stronach rankujących na to samo zapytanie? | US20200349181A1 (information gain) | Dodać unikalne dane: własne badania, case studies, eksperymenty |
| Pokrycie tematyczne | Jaki procent podtematów i fraz kluczowych z klastra jest pokryty treścią domeny? | US7536408B2 (phrase-based indexing) | Zidentyfikować luki frazowe w GSC i uzupełnić treść |
| Pokrycie encji | Czy treść zawiera i deklaruje kluczowe encje (osoby, produkty, pojęcia, miejsca) związane z tematem? Czy schema markup je identyfikuje? | US8812435B1 (learning objects and facts) | Dodać encje do treści i schema (Organization, Product, Person) |
| Przepływ autorytetu wewnętrznego | Czy strony w klastrze linkują do siebie z kontekstowymi anchorami? Czy autorytet silnych stron przepływa do słabszych? | US8577893B1 (anchor context ranking) | Zbudować siatkę linków wewnętrznych z anchorami pasującymi do tematu docelowego |
Każda warstwa odpowiada na inne pytanie diagnostyczne. Warstwa „popularność i zaangażowanie” mówi: czy użytkownicy w ogóle wchodzą w interakcję z tą treścią? Warstwa „information gain” mówi: czy ta treść wnosi coś nowego? Warstwa „przepływ autorytetu” mówi: czy strony klastra wzajemnie się wspierają? Klaster z silną popularnością, ale zerowym przepływem autorytetu, to zbiór niezależnych stron, które przypadkiem dotyczą tego samego tematu — nie klaster tematyczny w rozumieniu algorytmu.
Dlaczego brakujące warstwy obniżają score bardziej niż słabe warstwy
Diagnostyka autorytetu klastra jest evidence-aware: rozróżnia „brak danych” od „słabych danych”. Klaster z autorytetem autora 20/100 jest słaby, ale zdiagnozowany — wiemy, co poprawić. Klaster z autorytetem autora 0/100, bo nie dostarczono profilu autora do analizy, jest nieokreślony — diagnostyka nie może ocenić tej warstwy, więc traktuje ją jako lukę. W efekcie wynik zbiorczy (composite score) jest niższy, bo narzędzie nie może zwalidować autorytetu na tej warstwie. To ważne rozróżnienie: niski composite score nie zawsze oznacza słabą domenę — może oznaczać niekompletne dane wejściowe do audytu.
Jak patent US8949228B2 łączy interakcję z autorytetem — mechanizm krok po kroku

Patent US8949228B2 („Identification of new sources for topics”, Google LLC, zgłoszony 15 stycznia 2013, opublikowany 3 lutego 2015, wynalazcy: Nissan Hajaj, Garrett Yaun) opisuje pięcioetapowy proces budowania profilu tematycznego źródła. To nie jest abstrakcyjny koncept — to konkretny mechanizm z definicjami matematycznymi.
Etap 1: Pary dokument-tekst. System tworzy pary: dokument (strona) + tekst (zapytanie lub termin). Na przykład: strona „metody parzenia kawy” + zapytanie „jak parzyć kawę w chemexie”. Każda para ma źródło (domenę lub autora).
Etap 2: Dane interakcji. Dla każdej pary system zbiera dane behawioralne: kliknięcia (selection counts), wyświetlenia (impressions), czas na stronie (dwell time). Patent wyraźnie opisuje prowadzenie wielu liczników kliknięć dla różnych przedziałów dwell time — co oznacza, że krótkie kliknięcie (bounce po 3 sekundach) jest traktowane inaczej niż długie kliknięcie (5 minut czytania).
Etap 3: Obliczanie wag. Na podstawie danych interakcji system oblicza wagę dla każdej pary dokument-tekst. Waga uwzględnia nie tylko liczbę kliknięć, ale ich jakość — długie, zaangażowane sesje mają wyższą wagę. Patent opisuje formułę ważenia, w której CTR i dwell time są głównymi czynnikami.
Etap 4: Topic Modeler. Wagi z par dokument-tekst zasilają model tematyczny (Topic Modeler), który przypisuje źródłu tematy. Źródło z wieloma wysoko ważonymi parami na temat „kawy” zostaje skojarzone z tematem „kawa”. Im więcej par i im wyższe wagi — tym silniejsza asocjacja.
Etap 5: Cold start boost. Claim 9 patentu opisuje zastosowanie w rankingu: gdy nowy dokument pojawia się w indeksie, system sprawdza, czy jego źródło ma ustaloną asocjację z tematem dokumentu. Jeśli tak — dokument dostaje wyższy score w wynikach, nawet jeśli sam nie ma jeszcze historii kliknięć. To mechanizm „transferu autorytetu” — nowa strona na blogu kawowym o parzeniu V60 dziedziczy siłę domeny w temacie „kawa”, bo Topic Modeler już skojarzył to źródło z tym tematem.
Praktyczna implikacja: topical authority nie buduje się publikowaniem treści — buduje się interakcjami użytkowników z tą treścią w kontekście tematu. 10 artykułów, których nikt nie czyta, nie budują autorytetu. 3 artykuły z wysokim CTR, długimi sesjami i powracającymi użytkownikami budują go silnie. Więcej o mechanizmie source-topic interaction: diagnostyka source-topic interaction.
Źródła danych interakcji — nie tylko wyszukiwarka
Patent US8949228B2 nie ogranicza się do danych z Google Search. Claims 4, 5 i 6 wyraźnie opisują zbieranie danych interakcji z mediów społecznościowych, e-maili i feedów RSS/newsów. W tych kontekstach „tekstem” w parze dokument-tekst nie jest zapytanie wyszukiwarkowe, ale termin wyodrębniony z dokumentu (np. nagłówek artykułu udostępnionego na Facebooku). Oznacza to, że artykuł o parzeniu kawy, który generuje 500 kliknięć z wyszukiwarki i 200 kliknięć z Facebooka, buduje silniejszy profil tematyczny niż artykuł z samymi 500 kliknięciami organicznymi — bo system widzi interakcję z dwóch niezależnych źródeł danych.
Autorytet autora — patent US8458196B1 i dlaczego profil eksperta ma znaczenie algorytmiczne
Patent US8458196B1 („System and method for determining topic authority”, Google, 2012) opisuje mechanizm budowania „Authority Signature Value” dla autora. Nie jest to prosty score jakości — to kumulatywny wskaźnik, który akumuluje ważoną autorstwo na temacie across many documents. Im więcej autorytatywnych dokumentów autor opublikował na dany temat, tym wyższa jego wartość sygnatury autorytetu.
System działa tak: dla każdego dokumentu identyfikuje tematy (z wagami), identyfikuje autora, a następnie akumuluje wagi tematyczne tego autora. Jeśli Paweł Gontarek opublikował 15 artykułów o audycie SEO e-commerce, a system rozpoznał w nich temat „SEO e-commerce” z wysokimi wagami — Paweł buduje Authority Signature Value na ten temat. Nowy artykuł Pawła o audycie SEO dziedziczy tę wartość, analogicznie do cold start boost na poziomie źródła.
Co to oznacza w praktyce? Profil autora na stronie to nie „miły dodatek do E-E-A-T” — to potencjalny sygnał wejściowy do algorytmu. Strona bez zidentyfikowanego autora traci warstwę diagnostyczną. W audycie klastra tematycznego warstwa „autorytet autora” ocenia: czy treść ma profil autora z bio, zewnętrznymi linkami (sameAs do LinkedIn, Twitter), schema Person i rozpoznawalną historię publikacji w temacie. Brak profilu autora nie oznacza kary — oznacza brak sygnału, który mógłby wzmocnić ranking.
Information gain — dlaczego unikatowa treść rankuje wyżej
Information gain (patent US20200349181A1, „Contextual estimation of link information gain”, Google, zgłoszony 2018, opublikowany 2020) to mechanizm oceny, czy strona dostarcza informację, której użytkownik nie znajdzie na innych stronach w wynikach na to samo zapytanie. W kontekście topical authority information gain jest kluczową warstwą, bo odpowiada na pytanie: „czy ta domena wnosi coś nowego do tematu, czy powtarza to, co napisali inni?”.
Jak to działa: system porównuje treść dokumentu z treścią dokumentów, które użytkownik już widział lub które rankują na to samo zapytanie. Jeśli 9 z 10 stron w top 10 pisze „topical authority to liczba artykułów na temat” — strona, która dodaje analizę patentów, dane z wycieku API i własne badania, ma wysoki information gain. Strona, która powtarza „napisz 20 artykułów” — niski.
W praktyce information gain buduje się przez: własne dane i eksperymenty (np. wyniki audytu 50 domen), unikalne case studies (nie „firma X zwiększyła ruch”, ale konkretne metryki i kroki), cytowanie źródeł pierwotnych (patenty, badania, dane) zamiast powtarzania blogerów, i oferowanie frameworków diagnostycznych zamiast ogólnych porad. Klaster tematyczny z wysokim information gain na każdej stronie jest algorytmicznie silniejszy niż klaster z 20 stronami powtarzającymi te same informacje.

Case study: jak klaster tematyczny buduje (lub nie buduje) topical authority
Rozważmy dwa hipotetyczne sklepy internetowe z herbatą: Sklep A i Sklep B. Oba mają porównywalny asortyment i ruch organiczny. Ale ich podejście do treści jest fundamentalnie różne.
Sklep A: dużo treści, mało autorytetu
Sklep A opublikował 30 artykułów blogowych o herbatach. Tematy: „10 najlepszych herbat na jesień”, „herbata zielona vs czarna”, „jak zaparzyć herbatę”, „herbata na odchudzanie”, „herbata na sen”, „herbata dla dzieci”. Artykuły mają 800-1200 słów, powtarzają ogólne informacje z innych blogów, nie mają profilu autora, nie linkują do siebie wzajemnie (każdy artykuł jest samodzielną wyspą) i nie używają schema markup.
Diagnostyka klastra dla Sklepu A pokazuje: popularność — umiarkowana (użytkownicy klikają, bo tematy są popularne). Zaangażowanie tematyczne — niskie (popyt skoncentrowany na 2-3 ogólnych zapytaniach). Dopasowanie do zapytania — niskie (artykuł o „herbatach na jesień” nie odpowiada na pytanie użytkownika szukającego konkretnej herbaty rooibos). Information gain — minimalny (te same informacje co na 50 innych blogach). Pokrycie encji — zerowe (brak schema, brak deklaracji encji). Przepływ autorytetu — zerowy (brak linków wewnętrznych między artykułami). Wynik zbiorczy: popularność bez struktury. Google widzi 30 niezależnych stron, nie klaster tematyczny.
Sklep B: mniej treści, więcej autorytetu
Sklep B opublikował 8 artykułów, ale każdy pokrywa wąski podtemat z głębią: „profil smakowy herbat darjeeling first flush vs second flush — porównanie 12 odmian” (3 500 słów, tabele porównawcze, zdjęcia liści), „jak temperatura wody wpływa na ekstrakcję polifenoli — pomiary z 6 eksperymentów” (2 800 słów, wykresy, dane z eksperymentów), „przewodnik po japońskich ceremonialnych matchach — od ceremonial po culinary grade” (4 000 słów, infografika procesu produkcji). Każdy artykuł ma profil autora (właściciel sklepu — certyfikowany somelier herbaty), schema markup (Product, Article, Person z sameAs) i kontekstowe linki do innych artykułów w klastrze.
Diagnostyka klastra dla Sklepu B: popularność — umiarkowana do silnej (mniej kliknięć ogółem, ale wyższy CTR i dłuższe sesje). Zaangażowanie tematyczne — silne (popyt zróżnicowany: 25+ unikalnych zapytań z GSC). Dopasowanie do zapytania — wysokie (artykuły odpowiadają na konkretne intencje). Information gain — wysoki (własne eksperymenty, unikalne porównania). Pokrycie encji — silne (schema Product z odmianami, Person z certyfikacjami). Opinie klientów z analizą sentymentu i atrybutów wzmacniają warstwę zaufania. Przepływ autorytetu — aktywny (kontekstowe linki wewnętrzne z anchorami). Wynik zbiorczy: struktura autorytetowa. Google widzi spójny klaster tematyczny z wieloma warstwami autorytetu.
Co się dzieje w rankingu?
Gdy użytkownik wpisuje „najlepsza herbata darjeeling first flush” — Sklep B rankuje wyżej, mimo że ma mniej treści. Dlaczego? Bo ma silniejszą asocjację source-topic: wiele par dokument-tekst z wysokimi wagami (długie kliknięcia, wysoki CTR). Ma cold start boost: nowy artykuł Sklepu B o „darjeeling autumn flush” dziedziczy autorytet domeny w temacie „darjeeling”, bo Topic Modeler już skojarzył to źródło z tematem. Ma niski siteRadius: wszystkie strony są blisko centroidu tematycznego „herbata specjalistyczna”. I ma wysoki information gain: unikalne dane, których nie ma na innych stronach.
Sklep A ma 30 artykułów, ale wysoki siteRadius (tematy od zdrowia po dzieci), niski information gain (ogólniki), brak przepływu autorytetu (brak linków wewnętrznych) i słabe dopasowanie do zapytań (ogólne artykuły na konkretne zapytania). W modelu patentu US8949228B2 Sklep A ma słaby profil tematyczny mimo dużej ilości treści — bo interakcje użytkowników nie budują silnych, wysoko ważonych par dokument-tekst.
Dane z badań: co mówią liczby o topical authority
Badanie Graphite z 2024 roku (analiza 12 domen) dostarczyło jedne z pierwszych twardych danych o wpływie topical authority na ranking. Wyniki: strony z wysokim autorytetem tematycznym zyskują ruch 57% szybciej niż strony z niskim autorytetem. Dodatkowo artykuły z wysokim autorytetem tematycznym mają 62% wyższe prawdopodobieństwo zdobycia ruchu w pierwszym tygodniu od publikacji i osiągają kamienie milowe wyświetleń 30% szybciej. To potwierdzenie mechanizmu cold start boost z patentu — domeny z ustaloną asocjacją tematyczną szybciej zyskują widoczność dla nowych treści.
Dane HubSpot z wdrożenia modelu topic clusters: po reorganizacji treści w klastry tematyczne (zamiast rozproszonych blogpostów) sesje organiczne wzrosły o 13% tydzień do tygodnia. Na jednym słowie kluczowym zanotowali 1 500% wzrost kliknięć z SERP. HubSpot był jednym z pierwszych dużych graczy, który publicznie opisał przejście z modelu „keyword-first” na „topic-first” w 2017 roku — i dane potwierdzają, że struktura tematyczna wpływa na widoczność.
Raport Moz Search Ranking Factors 2024 pokazał przesunięcie: słowa kluczowe i backlinki odpowiadają za mniej niż 40% wpływu na ranking. Reszta to sygnały semantyczne — w tym topical authority, E-E-A-T i dopasowanie intencji. To fundamentalna zmiana: od „optymalizuj pod słowa kluczowe” do „buduj autorytet w temacie”.
Obserwacje z audytów e-commerce (dane Semgence, anonimizowane): sklepy, które zreorganizowały treść w klastry tematyczne po aktualizacji Helpful Content z 2024 roku, odnotowały wzrosty ruchu organicznego o 30-110% w ciągu 6 miesięcy. Najsilniejsze wzrosty zanotowały sklepy, które jednocześnie uzupełniły profile autorów, dodały schema markup i przebudowały linkowanie wewnętrzne — czyli wzmocniły wiele warstw autorytetu naraz, nie tylko „napisały więcej artykułów”.
Audyt klastrów semgence.pl — co pokazują 3 klastry z różnymi profilami autorytetu
Żeby zilustrować, jak wielowarstwowa diagnostyka działa w praktyce, uruchomiliśmy audyt autorytetu klastra na 12 stronach z 3 klastrów tematycznych semgence.pl: „SEO e-commerce” (6 stron), „widoczność w AI” (4 strony), „content marketing” (2 strony). Dane: 16 wierszy GSC (90 dni), średni CTR 4.04%, średnia ważona pozycja 10.4. Celowo nie podłączono GA4 i nie dostarczono pełnego crawlu linków wewnętrznych — żeby pokazać, jak brakujące dane wpływają na wynik diagnostyki.
Wynik zbiorczy: popularność i zaangażowanie 73/100, jakość widoczności GSC 83/100 — obie warstwy silne. Ale zbiorczy autorytet klastra 16/100. Ta rozbieżność nie jest sprzeczna — to dokładnie sygnał, który patent opisuje. Użytkownicy klikają i angażują się (popularność), ale klaster nie demonstruje pełnej głębokości tematycznej na pozostałych warstwach. Niski score zbiorczy wynika z niekompletnych danych (5 z 9 warstw ma score bliski 0, bo nie dostarczono danych wejściowych), nie z obiektywnej słabości domeny.
Klaster „SEO e-commerce” — silny engagement, ukryte referencje
Najgłębszy klaster: 6 stron pokrywających extractability score, spójność DOM-Product-Schema, agentic commerce readiness, action readiness i MerchantReturnPolicy. Łącznie 209 kliknięć GSC. Tematy wzajemnie się referencjonują w treści (artykuł o extractability odwołuje się do spójności DOM, artykuł o action readiness do schema produktu). Ale diagnostyka nie widzi tych referencji, bo nie dostarczono danych o linkach wewnętrznych — warstwa „przepływ autorytetu” wynosi 0/100. To artefakt brakujących danych, nie braku linków. Po uzupełnieniu crawlu linków ta warstwa wzrośnie.
Klaster „widoczność w AI” — spójny, ale płytki
4 strony: pozycjonowanie AI, audyt widoczności w AI, rendering readiness, retrieval AI search. 151 kliknięć. Tematy są spójne (niski siteRadius — blisko centroidu „widoczność w AI”), ale głębokość jest mniejsza niż w klastrze e-commerce. „Pozycjonowanie w AI” generuje 55 kliknięć z pozycji 6.4 — to query-leader klastra. Pozostałe strony wspierają ten temat, ale mają mniej zapytań GSC. Żeby wzmocnić ten klaster, potrzeba 2-3 dodatkowych stron pokrywających podtematy: jak mierzyć widoczność marki w Claude/Perplexity, jak optymalizować treść pod cytowania AI, jak monitorować zmiany w AI search.
Klaster „content marketing” — za mało stron na klaster
2 strony: content marketing (CTR 2.3%, pozycja 15.8) i audyt treści (CTR 4.3%, pozycja 10.5). Łącznie 66 kliknięć. Content marketing ma najniższy CTR w zbiorze i najwyższą (najgorszą) pozycję — sugeruje problem z dopasowaniem intencji: użytkownik wpisujący „content marketing” oczekuje czegoś innego niż to, co oferuje strona. Dwie strony nie tworzą klastra — tworzą parę. Bez dodatkowych stron pokrywających podtematy (strategia contentowa, content calendar, audyt efektywności treści, content brief) ten klaster nie zbuduje źródło-temat asocjacji. W modelu patentu Topic Modeler potrzebuje wielu par dokument-tekst z tego samego tematu, żeby ustalić asocjację — 2 pary to za mało. Więcej o strategii treści: content marketing.
Topical authority a inne sygnały jakości — jak to współgra
Autorytet tematyczny nie działa w izolacji. Jest jednym z kilku mechanizmów na poziomie domeny (site-level), które Google opisuje w patentach i które potwierdził wyciek dokumentacji API. Poniższa tabela pokazuje, jak topical authority współgra z innymi sygnałami.
| Mechanizm | Patent / źródło | Co mierzy | Jak łączy się z topical authority |
|---|---|---|---|
| Source-topic interaction | US8949228B2 | Zaangażowanie użytkowników z treścią źródła w kontekście tematu | Bezpośrednio buduje profil tematyczny — fundament topical authority |
| Site quality score | US9031929B1 | Stosunek branded queries do ogólnych wyświetleń | Branded queries tematyczne (np. „semgence audyt SEO”) wzmacniają oba sygnały jednocześnie |
| siteFocusScore | Wyciek API 2024 | Skupienie tematyczne domeny | Wysoki siteFocusScore = silny sygnał specjalizacji, wzmacnia topical authority |
| siteRadius | Wyciek API 2024 | Odchylenie stron od centroidu domeny | Strony z niskim siteRadius wzmacniają klaster; z wysokim — rozmywają go |
| NavBoost | Proces DOJ 2023-2024 | Reranking na podstawie 13 miesięcy danych klikowych | Strony z dobrymi sygnałami NavBoost (długie kliknięcia) zasilają dane source-topic interaction |
| siteAuthority | Wyciek API 2024 | Ogólna autorytetność domeny (compressed quality signal) | Topical authority na wielu tematach buduje ogólny siteAuthority |
Kluczowa obserwacja: wszystkie te sygnały wzajemnie się zasilają. Silna asocjacja source-topic generuje lepsze pozycje w rankingu. Lepsze pozycje generują więcej kliknięć i dłuższe sesje. Więcej interakcji wzmacnia source-topic interaction. Branded queries tematyczne (użytkownicy szukający „[marka] + [temat]”) jednocześnie budują site quality score i topical authority. To pętla sprzężenia zwrotnego — ale działa w obie strony. Słaba treść → mało kliknięć → słabe source-topic → gorsze pozycje → jeszcze mniej kliknięć.
7 kroków do budowania topical authority — framework diagnostyczny
Poniższy framework nie wymaga specjalistycznych narzędzi. Każdy krok można wykonać z dostępem do GSC, GA4 i podstawowego crawlera (Screaming Frog, Ahrefs Site Audit).
Krok 1: Zmapuj klastry tematyczne
Wyciągnij z GSC wszystkie zapytania, na które rankujesz. Pogrupuj je w klastry tematyczne (nie kategorii URL-owe, ale tematyczne). Użyj prostej heurystyki: zapytania, które mają wspólny landing page lub pokrywające się intencje, trafiają do jednego klastra. Oceń: ile klastrów masz? Ile stron w każdym? Ile zapytań GSC? Klaster z jednym zapytaniem i jedną stroną to nie klaster — to strona.
Krok 2: Oceń Topic Share
Dla każdego klastra sprawdź: jaki procent zapytań w tym temacie generuje kliknięcia na Twoją domenę? Porównaj z konkurencją. Jeśli na 20 zapytań o „audyt SEO e-commerce” rankujesz na 15, a konkurent na 18 — masz niższy Topic Share. Nie chodzi o jednorazowy snapshot — monitoruj kwartalnie, żeby widzieć trend.
Krok 3: Uzupełnij brakujące warstwy autorytetu
Najszybsze wzrosty daje uzupełnienie warstw, które kosztują mało, a mają duży wpływ: profil autora z bio, zdjęciem, linkami sameAs (LinkedIn, Twitter) i schema Person — wzmacnia warstwę „autorytet autora”. Schema markup na stronach (Article, Product, Organization, FAQ) — wzmacnia warstwę „pokrycie encji”. Linki wewnętrzne z kontekstowymi anchorami — wzmacnia warstwę „przepływ autorytetu”. To nie wymaga pisania nowych artykułów — wymaga wzbogacenia istniejących. Więcej o audycie treści jako punkcie startowym.
Krok 4: Pogłęb pozorne klastry
Klaster z 2 stronami potrzebuje 3-5 dodatkowych stron pokrywających podtematy. Ale nie dowolne 3-5 stron — takie, które odpowiadają na zapytania z GSC. Jeśli „content marketing seo” ma 1 200 wyświetleń, ale CTR 2.3%, to treść nie odpowiada na intencję. Zamiast pisać nowy artykuł, może wystarczy przebudować istniejący pod faktyczną intencję zapytania. Sprawdź w GSC: na jakie zapytania rankujesz z niskim CTR? To zapytania, gdzie treść nie spełnia oczekiwań.
Krok 5: Zbuduj information gain
Przejrzyj top 10 wyników na główne zapytanie klastra. Co każdy z nich pisze? Jaki jest „consensus” — informacja, którą mają wszyscy? I co Ty możesz dodać, czego nie mają inni? Własne dane, eksperymenty, case studies z konkretnymi liczbami, analizy patentów, wywiady z ekspertami — to buduje information gain. Artykuł, który powtarza consensus bez dodania nowej wartości, będzie miał niski information gain i trudno zbuduje autorytet.
Krok 6: Zbuduj przepływ autorytetu wewnętrznego
Strony w klastrze muszą linkować do siebie kontekstowo. Patent US8577893B1 opisuje, że kontekst anchora (tekst linku + otaczające zdanie) jest sygnałem powiązania tematycznego. Link „więcej o action readiness produktu” z artykułu o extractability jest silniejszym sygnałem niż generyczny „czytaj dalej”. Zbuduj siatkę linków, w której każda strona linkuje do 2-3 innych stron w klastrze, z anchorami zawierającymi temat docelowy. Więcej o strategii linkowania wewnętrznego.
Krok 7: Monitoruj w czasie i reaguj na decay
Source-topic interaction z patentu US8949228B2 akumuluje się w czasie. Jednorazowy audyt daje snapshot — ale topical authority to trend. Porównanie metryki co kwartał pokaże, czy klaster się wzmacnia, stagnuje czy słabnie. Spadek zaangażowania przy stałej treści to sygnał content decay — strony tracą aktualność, konkurenci opublikowali lepszą treść, intencja zapytania się zmieniła. Reaguj: odśwież treść, dodaj nowe dane, zaktualizuj przykłady. Więcej o monitorowaniu w kontekście AI: pozycjonowanie AI i audyt widoczności w AI.
Czego topical authority NIE mierzy
Warto być precyzyjnym o ograniczeniach. Topical authority w rozumieniu patentów i danych z wycieku API nie mierzy jakości tekstu (czy jest dobrze napisany, czy ma błędy językowe, czy jest plagiatem). Nie mierzy estetyki strony (design, UX, szybkość ładowania — to osobne sygnały). Nie mierzy popularności w mediach społecznościowych (lajki i followersów — choć patent US8949228B2 zbiera dane interakcji z social media, to nie mierzy „popularności” w sensie viralowym). I nie jest jedynym czynnikiem rankingowym — strona z silnym topical authority, ale fatalnym Core Web Vitals, problemami z indeksowaniem lub spamowym profilem linkowym nadal może rankować słabo.
Topical authority to jeden z mechanizmów site-level — ważny, ale nie jedyny. Traktuj go jako warstwę, która współgra z innymi: audyt SEO sprawdza fundamenty techniczne, topical authority sprawdza fundamenty tematyczne. Oba są potrzebne.
Źródła i metodologia
Patenty: US8949228B2 — „Identification of new sources for topics”, Google LLC, Nissan Hajaj, Garrett Yaun, 2013/2015. US8458196B1 — „System and method for determining topic authority”, Google, 2012. US20200349181A1 — „Contextual estimation of link information gain”, Google, 2018/2020. US8577893B1 — „Ranking based on reference contexts”, Google. US9031929B1 — „Site quality score”, Google, April R. Lehman, Navneet Panda.
Badania i dane: Graphite, „Topical Authority White Paper”, 2024 — badanie 12 domen, 57% szybszy ruch dla stron z wysokim autorytetem tematycznym. Kevin Indig, „How to measure topical authority”, Growth Memo, 2025 — metodologia Topic Share. Moz, „Search Ranking Factors 2024″ — przesunięcie od keywords+backlinks do sygnałów semantycznych. HubSpot, „Topic Clusters”, 2017-2024 — 13% wzrost sesji organicznych po wdrożeniu modelu klastrowego.
Wyciek dokumentacji API Google (maj 2024): atrybuty siteFocusScore, siteRadius, site2vecEmbeddingEncoded w module QualityNsrNsrData (Normalized Site Rank). Potwierdzenie algorytmicznego mierzenia specjalizacji tematycznej.
Dane audytu: 12 stron semgence.pl, 3 klastry, 16 wierszy GSC (90 dni), sierpień 2026. Scoringi są wskaźnikami diagnostycznymi Semgence opartymi na danych GSC i crawlu. Nie są wynikami Google. Niski wynik zbiorczy (16/100) wynika głównie z celowo niekompletnych danych wejściowych — celem audytu było pokazanie wpływu brakujących warstw, nie ocena domeny. Pełna diagnostyka topical authority: konsultacje SEO.
Czym różni się topical authority od domain authority?
Domain authority (DA) to metryka zewnętrzna (Moz, Ahrefs) oparta głównie na profilu linkowym — ile domen linkuje do Twojej strony. Topical authority to ocena ekspertyzy domeny w konkretnym temacie, oparta na interakcjach użytkowników, pokryciu tematycznym, information gain i strukturze wewnętrznej. Domena może mieć niski DA, ale silny topical authority w wąskiej niszy — i rankować wysoko na zapytania z tego tematu. I odwrotnie: wysoki DA bez głębokości tematycznej nie gwarantuje pozycji na specjalistyczne zapytania.
Ile stron potrzebuje klaster, żeby budować topical authority?
Nie ma magicznej liczby. Klaster z 4 głębokimi stronami pokrywającymi kluczowe podtematy może mieć wyższy autorytet niż klaster z 20 powierzchownymi stronami. Kluczowe jest pokrycie zapytań GSC z intencją, pokrycie encji i wewnętrzne powiązania. Obserwacje z audytów: 5-8 stron w klastrze to minimum dla stabilnych wyników, ale jakość i powiązania mają większy wpływ niż ilość.
Czy engagement wystarczy do topical authority?
Nie. W audycie semgence.pl popularność i zaangażowanie wynosi 73/100, ale zbiorczy autorytet klastra to 16/100. Engagement pokazuje, że użytkownicy klikają i czytają — ale bez pokrycia encji, przepływu autorytetu wewnętrznego i information gain wyszukiwarka nie ma pełnego obrazu tematycznej ekspertyzy domeny. Engagement to warunek konieczny, nie wystarczający.
Jak szybko rośnie topical authority?
Patent US8949228B2 opisuje akumulację sygnałów w czasie. Obserwacje z audytów: 3-6 miesięcy od pierwszej publikacji w klastrze do stabilizacji sygnałów source-topic interaction. Szybsze wyniki daje uzupełnienie istniejących stron (encje, linki, profil autora) niż pisanie nowych. Badanie Graphite potwierdza: strony z wysokim autorytetem tematycznym zyskują ruch 57% szybciej, a artykuły mają 62% wyższe prawdopodobieństwo zdobycia ruchu w pierwszym tygodniu.
Co to jest information gain i dlaczego jest ważny?
Information gain (patent US20200349181A1) mierzy, czy strona dostarcza informację, której użytkownik nie znajdzie na innych stronach w wynikach na to samo zapytanie. Wysoki information gain oznacza, że treść wnosi coś nowego: własne dane, eksperymenty, unikalne case studies. Niski information gain oznacza powtarzanie tego, co napisali inni. W kontekście topical authority information gain jest kluczowy, bo odróżnia domenę, która naprawdę jest ekspertem (ma unikalne spostrzeżenia) od domeny, która tylko dużo pisze na temat.
Jak site quality score (US9031929B1) łączy się z topical authority?
Site quality score mierzy stosunek branded queries (zapytania nawigacyjne kierowane na domenę) do ogólnej widoczności domeny. Branded queries tematyczne — np. 'semgence audyt SEO’ zamiast po prostu 'semgence’ — to jednoczesny sygnał dla site quality score i topical authority. Silna asocjacja źródło-temat generuje więcej branded queries na dany temat, co wzmacnia site quality score w pętli sprzężenia zwrotnego.

