Słownik
Słownik widoczności w AI
Pojęcia, którymi opisujemy widoczność firm w odpowiedziach AI: od GEO i RAG po wskaźnik pojawień. Każde hasło zaczyna się od definicji w jednym zdaniu, dalej trzy najważniejsze punkty i opis mechanizmu.
Fundamenty
- AEO (optymalizacja pod silniki odpowiedzi) Optymalizacja pod silniki odpowiedzi (AEO) to zbiór praktyk redakcyjnych i technicznych, których celem jest zwiększenie szansy, że treść marki zostanie pobrana, zacytowana lub sparafrazowana przez silnik odpowiedzi, taki jak Perplexity, ChatGPT Search czy Google AI Overviews, w momencie generowania odpowiedzi dla użytkownika.
- Cytowanie w odpowiedzi AI Cytowanie w AI to wskazanie konkretnego adresu URL przez silnik generatywny jako źródła fragmentu użytego do zbudowania odpowiedzi.
- GEO (optymalizacja pod silniki generatywne) Optymalizacja pod silniki generatywne (GEO) to zbiór praktyk redakcyjnych i technicznych zwiększających szansę, że marka lub treść pojawi się wewnątrz odpowiedzi generowanej przez silnik AI, taki jak ChatGPT, Perplexity lub Google AI Overviews.
- Potwierdzenie encji w wielu źródłach Potwierdzenie encji w wielu źródłach to zjawisko, w którym silnik generatywny wybiera markę lub fakt do odpowiedzi wtedy, gdy ta sama informacja powtarza się w wielu niezależnych źródłach, którym model przypisuje zaufanie.
- Przeglądy AI w Google (AI Overviews) Przeglądy AI w Google to generowane przez model językowy bloki tekstowe pojawiające się na górze strony wyników Google.
- SEO a GEO SEO (Search Engine Optimization) to praktyka zwiększania widoczności strony w organicznych wynikach wyszukiwania przez poprawę pozycji rankingowej, a GEO (Generative Engine Optimization) to praktyka zwiększania szansy, że marka lub treść zostanie przywołana wewnątrz wygenerowanej odpowiedzi silnika AI.
- Silnik generatywny Silnik generatywny pobiera dokumenty z indeksu, scala je w kontekst i generuje jedną spójną odpowiedź w języku naturalnym.
- Silnik odpowiedzi Silnik odpowiedzi to system wyszukiwania, który zwraca użytkownikowi gotową, sformułowaną odpowiedź na pytanie.
- Tryb AI w Google (AI Mode) Tryb AI w Google to dedykowany interfejs wyszukiwarki, w którym model językowy generuje rozbudowaną, wieloakapitową odpowiedź, a cytowane źródła są osadzone bezpośrednio w tej odpowiedzi.
- Uziemienie odpowiedzi (grounding) Uziemienie odpowiedzi to właściwość generatywnego silnika polegająca na tym, że każde twierdzenie w wygenerowanej odpowiedzi jest zakorzenione w konkretnym, pobranym fragmencie źródłowym, co pozwala modelowi wskazać dokument, z którego pochodzi dana informacja.
Platformy AI
- Gemini Gemini to rodzina modeli językowych Google DeepMind, zintegrowana z wyszukiwarką Google jako silnik generujący odpowiedzi w AI Overviews i AI Mode.
- Graf wiedzy Graf wiedzy to ustrukturyzowana baza danych, w której encje, takie jak firmy, osoby i miejsca, są połączone nazwanymi relacjami, co pozwala silnikom AI i wyszukiwarkom rozumieć znaczenie pojęć oraz wzajemne powiązania między nimi bez analizowania surowego tekstu.
- Microsoft Copilot Microsoft Copilot to generatywny silnik odpowiedzi wbudowany w ekosystem Microsoft, który łączy modele językowe z indeksem Bing, pobiera fragmenty stron w czasie rzeczywistym i syntetyzuje odpowiedź z cytowanymi źródłami bezpośrednio w interfejsie Windows, Edge, Microsoft 365 i na stronie copilot.microsoft.com.
- Perplexity Perplexity to silnik odpowiedzi (answer engine) działający w modelu RAG, który na każde zapytanie pobiera aktualne strony internetowe, syntetyzuje je w jedną odpowiedź i dołącza numerowane cytowania wskazujące źródła użyte podczas generowania.
- Pobieranie źródeł (retrieval) Pobieranie źródeł to etap w potoku RAG, w którym silnik generatywny wyszukuje fragmenty tekstu semantycznie zbliżone do zapytania użytkownika, a następnie przekazuje je modelowi językowemu jako kontekst do sformułowania odpowiedzi.
- Profil Firmy w Google Profil Firmy w Google to bezpłatny panel Google, w którym właściciel firmy publikuje ustrukturyzowane dane o marce: nazwę, adres, numer telefonu, godziny otwarcia, kategorie i opinie, a silniki AI traktują te dane jako zweryfikowane źródło encji przy budowaniu odpowiedzi lokalnych.
- Roboty AI Roboty AI to zautomatyzowane programy indeksujące, które producenci modeli językowych (OpenAI, Google, Anthropic, Perplexity) wysyłają po treści stron internetowych, by budować lub aktualizować korpusy danych służące do trenowania modeli i zasilania potoków RAG odpowiedzialnych za generowanie odpowiedzi.
- Rozbijanie zapytania (query fan-out) Rozbijanie zapytania to mechanizm, w którym silnik generatywny rozkłada jedno pytanie użytkownika na kilka lub kilkanaście węższych podzapytań, uruchamia dla każdego z nich osobne wyszukiwanie i scala wyniki przed wygenerowaniem odpowiedzi.
- Wyszukiwarka ChatGPT (ChatGPT Search) Wyszukiwarka ChatGPT to funkcja modelu OpenAI, która łączy generowanie języka naturalnego z pobieraniem aktualnych stron internetowych, a wynik prezentuje jako spójną odpowiedź tekstową z przypisanymi cytowaniami do źródeł.
- Zależność od indeksu wyszukiwarki Zależność od indeksu wyszukiwarki oznacza, że silnik AI może zacytować wyłącznie stronę, która jest zaindeksowana i dostępna dla jego robotów.
Treść i format
- Cytowalność Cytowalność to właściwość fragmentu treści, która sprawia, że model językowy wybiera go jako gotowy cytat do wygenerowanej odpowiedzi: fragment niesie pełną myśl, jest zrozumiały po wyjęciu ze strony i zawiera konkretne dane lub atrybucję ekspercką.
- Cytowanie źródeł w treści Cytowanie w treści to praktyka umieszczania w tekście bezpośrednich odwołań do źródeł zewnętrznych, takich jak badania, raporty lub dane liczbowe, w miejscu, gdzie dana informacja się pojawia, co zwiększa wiarygodność fragmentu i jego szansę na pobranie przez silnik generatywny.
- E-E-A-T (doświadczenie, ekspertyza, autorytet, zaufanie) E-E-A-T to cztery sygnały jakości treści: doświadczenie, ekspertyza, autorytet i zaufanie, uwzględniane przez silniki generatywne przy selekcji źródeł do cytowania.
- Klaster tematyczny Klaster tematyczny to zbiór powiązanych stron lub sekcji serwisu, które razem pokrywają jeden temat z wielu kątów, tworząc spójną sieć encji i pojęć rozpoznawalną przez silniki generatywne jako sygnał głębokości tematycznej.
- Lista rankingowa (listicle) Lista rankingowa to format treści prezentujący pozycje w ponumerowanej lub wypunktowanej kolejności, który generatywne silniki wyszukiwania chętnie cytują przy zapytaniach porównawczych, ponieważ struktura listy ułatwia wyodrębnienie pojedynczego elementu jako samodzielnego fragmentu odpowiedzi.
- Nagłówek w formie pytania Nagłówek w formie pytania to nagłówek HTML (H2 lub H3) sformułowany jako pełne pytanie użytkownika, dzięki czemu silnik generatywny może dopasować sekcję do zapytania i pobrać ją jako samodzielny fragment odpowiedzi, bez potrzeby analizowania całej strony.
- Samodzielny fragment Samodzielny fragment to sekcja treści, która niesie pełną myśl i jest zrozumiała po wyjęciu ze strony, bez odwoływania się do otaczającego kontekstu, co pozwala silnikowi generatywnemu pobrać ją i zacytować bez zniekształcenia sensu.
- Sekcja FAQ (FAQPage) Sekcja FAQ to blok pytań i odpowiedzi na stronie, oznaczony znacznikiem FAQPage ze słownika Schema.org, który pozwala silnikom generatywnym pobrać parę pytanie-odpowiedź jako gotowy, samodzielny fragment do zacytowania w wygenerowanej odpowiedzi.
- Statystyki w treści Statystyki w treści to konkretne liczby i dane ilościowe osadzone bezpośrednio w tekście strony.
- Struktura answer-first Struktura answer-first to sposób organizacji treści, w którym bezpośrednia odpowiedź na pytanie pojawia się w pierwszym zdaniu lub akapicie sekcji, zanim nastąpi rozwinięcie, uzasadnienie lub przykłady, co zwiększa szansę, że silnik generatywny pobierze ten fragment jako cytat.
- Świeżość treści Świeżość treści to właściwość strony polegająca na tym, że jej dane, liczby i fakty odpowiadają aktualnemu stanowi wiedzy, co zwiększa prawdopodobieństwo, że silnik generatywny wybierze ten fragment jako źródło cytowania w odpowiedzi.
- Tabela porównawcza Tabela porównawcza to ustrukturyzowany format treści, w którym cechy kilku obiektów zestawione są w wierszach i kolumnach, co pozwala silnikom generatywnym wyodrębnić konkretne atrybuty i włączyć je do odpowiedzi na zapytania porównawcze bez konieczności przetwarzania całego dokumentu.
Encje i dane strukturalne
- Dane strukturalne (schema.org) Dane strukturalne (Schema.org) to semantyczny kod osadzony w HTML strony, który opisuje jej zawartość w języku zrozumiałym dla maszyn: typ encji, atrybuty, relacje i kontekst, dzięki czemu silniki wyszukiwania i generatywne mogą precyzyjnie zidentyfikować, co strona reprezentuje.
- DefinedTerm DefinedTerm to typ encji w słowniku Schema.org, który pozwala oznaczyć definicję pojęcia w kodzie strony tak, aby silniki AI i wyszukiwarki rozpoznały ją jako ustrukturyzowaną, wiarygodną odpowiedź na pytanie „czym jest X” i mogły ją pobrać bezpośrednio do wygenerowanej odpowiedzi.
- Encja Encja to jednoznacznie identyfikowalny obiekt rzeczywisty lub pojęciowy, taki jak marka, osoba, miejsce czy produkt, który modele językowe i silniki wyszukiwania rozpoznają jako spójną jednostkę wiedzy i łączą z konkretnymi atrybutami w grafie wiedzy.
- Gęstość encji Gęstość encji to miara liczby rozpoznawalnych encji (osób, miejsc, organizacji, pojęć) przypadających na jednostkę tekstu.
- Obecność w Wikidata Obecność w Wikidata to posiadanie przez markę lub podmiot własnego, ustrukturyzowanego rekordu w otwartej bazie wiedzy Wikidata, co pozwala silnikom generatywnym powiązać nazwę firmy z weryfikowalnymi atrybutami: branżą, lokalizacją, powiązanymi osobami i identyfikatorami w innych bazach danych.
- Plik llms.txt Plik llms.txt to plik tekstowy umieszczany w katalogu głównym domeny, który dostarcza modelom językowym skondensowany, ustrukturyzowany opis zawartości witryny, kluczowych encji i preferowanych źródeł.
- Plik robots.txt i roboty AI Plik robots.txt dla robotów AI to konfiguracja pliku robots.txt, w której właściciel witryny określa, które roboty generatywnych silników wyszukiwania mają prawo indeksować treść strony.
- Powiązanie sameAs Powiązanie sameAs to właściwość Schema.org, która informuje silniki wyszukiwania i modele językowe, że dany podmiot na stronie jest tą samą encją co konkretny wpis w zewnętrznej bazie wiedzy, takiej jak Wikidata, Wikipedia lub Google Knowledge Graph, co pozwala systemom AI jednoznacznie zidentyfikować markę, osobę lub miejsce.
- Spójność NAP (nazwa, adres, telefon) Spójność NAP to jednolitość danych identyfikacyjnych firmy, czyli nazwy, adresu i numeru telefonu, we wszystkich miejscach w sieci, co pozwala silnikom AI i wyszukiwarkom powiązać rozproszone wzmianki z jedną encją i zwiększa szansę na cytowanie marki w odpowiedziach generatywnych.
- Ujednoznacznienie encji Ujednoznacznienie encji to proces, w którym silnik AI lub graf wiedzy jednoznacznie przypisuje wzmiankę tekstową (np. nazwę marki, osoby lub miejsca) do konkretnego, unikalnego rekordu w swojej bazie danych.
Mechanika modeli
- Budżet źródeł w odpowiedzi Budżet źródeł w odpowiedzi to ograniczona liczba adresów URL, które silnik generatywny może przytoczyć w jednej odpowiedzi.
- Dzielenie na fragmenty (chunking) Dzielenie na fragmenty to mechanizm przetwarzania treści w potokach RAG, w którym strona jest rozbijana na mniejsze, osobno osadzane w przestrzeni wektorowej jednostki tekstu, a następnie pobierana jest tylko ta jednostka, która semantycznie najlepiej odpowiada zapytaniu użytkownika.
- Halucynacja modelu Halucynacja modelu to zjawisko, w którym model językowy generuje informację brzmiącą wiarygodnie, lecz niemającą pokrycia w pobranych dokumentach ani w danych treningowych.
- Okno kontekstu Okno kontekstu to maksymalna liczba tokenów, którą model językowy przetwarza jednocześnie podczas generowania odpowiedzi.
- RAG (generowanie wspomagane pobieraniem) Generowanie wspomagane pobieraniem (RAG) to architektura, w której model językowy przed wygenerowaniem odpowiedzi pobiera z zewnętrznego indeksu fragmenty dokumentów semantycznie zbliżone do zapytania, a następnie włącza je do kontekstu generowania, co pozwala odpowiedzi opierać się na aktualnych, konkretnych źródłach.
- Ranking fragmentów Ranking fragmentów to mechanizm, w którym silnik AI ocenia i szereguje poszczególne wycinki tekstu ze strony pod kątem semantycznego dopasowania do zapytania, a następnie pobiera fragmenty o najwyższym podobieństwie do okna kontekstowego modelu generatywnego.
- Ważenie świeżości Ważenie świeżości to mechanizm, w którym silniki generatywne przypisują wyższy priorytet treściom opublikowanym lub zaktualizowanym niedawno, co sprawia, że strony z aktualnymi danymi mają większą szansę trafić do wygenerowanej odpowiedzi.
- Wektor semantyczny (embedding) Wektor semantyczny (embedding) to liczbowa reprezentacja fragmentu tekstu w przestrzeni wielowymiarowej, w której bliskość między wektorami odpowiada bliskości znaczenia, co pozwala silnikowi RAG odnaleźć fragmenty treści semantycznie pasujące do zapytania użytkownika.
Pomiar widoczności
- Cytowanie widmo Cytowanie widmo to sytuacja, w której silnik generatywny umieszcza URL domeny jako źródło odpowiedzi, przy czym nazwa tej marki nie pojawia się w wygenerowanym tekście.
- Luka wzmianek Luka wzmianek mierzy różnicę między liczbą wzmianek danej marki w zewnętrznych źródłach internetowych a liczbą wzmianek konkurentów.
- Pozycja cytowania Pozycja cytowania to miejsce, w którym silnik generatywny umieszcza odnośnik do danego źródła w swojej odpowiedzi.
- Przedział ufności pomiaru Przedział ufności pomiaru to zakres wartości, w którym z określonym prawdopodobieństwem mieści się prawdziwy wynik metryki GEO.
- Stabilność między przebiegami Stabilność między przebiegami to miara tego, jak bardzo wyniki generatywnego silnika wyszukiwania zmieniają się przy wielokrotnym zadaniu identycznego zapytania, wyrażana jako podobieństwo Jaccarda między zbiorami cytowanych marek lub źródeł w kolejnych przebiegach.
- Styl frazowania pytania Styl frazowania to rejestr językowy zapytania i treści, obejmujący skalę od formalnego po potoczny i slangowy.
- Udział w odpowiedziach AI (SOV) Udział w odpowiedziach AI (SOV) mierzy, jak często marka pojawia się w odpowiedziach generatywnych silników AI na zestaw zapytań z danej kategorii.
- Widoczność a dostęp Widoczność oznacza, że nazwa marki pada w wygenerowanej odpowiedzi, a dostęp, że silnik sięgnął po stronę marki jako źródło, nawet gdy jej nazwy nie przywołał.
- Wskaźnik pojawień (appearance rate) Wskaźnik pojawień to metryka GEO mierząca, jak często marka lub domena pojawia się w odpowiedziach generatywnego silnika na zdefiniowany zestaw zapytań.
- Zamrożony panel pytań Zamrożony panel pytań to ustalona, niezmieniana lista zapytań testowych, uruchamiana wielokrotnie w identycznej formie.
Te pojęcia dotyczą także Państwa firmy.
Bezpłatny Zwiad pokaże, w ilu odpowiedziach AI pada jej nazwa i kogo AI wymienia zamiast niej. Na zgłoszenie, bez zobowiązania.