

Kiedy ktoś zadaje pytanie asystentowi opartemu na sztucznej inteligencji, to właśnie źródła, do których ten odsyła, decydują o tym, czego dana osoba się dowiaduje i z jakimi markami się styka. Zastanawialiśmy się więc… w jaki sposób te asystenty wybierają swoje źródła? Czy zachowanie to różni się w zależności od języka, kraju, tematyki i systemu sztucznej inteligencji?
Tak jak w przypadku wszystkich innych pytań, które mieliśmy, postanowiliśmy to zbadać.
Opracowaliśmy 400 pytań obejmujących 5 kategorii tematycznych i 3 poziomy szczegółowości, sformułowaliśmy każde z nich w języku angielskim, francuskim, hiszpańskim i japońskim, a następnie przekazaliśmy je do 4 systemów sztucznej inteligencji w 5 krajach. Otrzymaliśmy w ten sposób ponad 16 000 odpowiedzi i zarejestrowaliśmy każde źródło, na które powołał się każdy z systemów.
Wyraźnie wyłoniło się kilka tendencji. Niektóre dotyczą ogólnego sposobu funkcjonowania tych systemów, ale ta, która ma największe znaczenie dla każdej marki wchodzącej na nowe rynki, dotyczy – jak można się domyślić – języka.
Zacznijmy więc.
Chcieliśmy, aby zbiór zapytań odzwierciedlał prawdziwą ciekawość, a nie standardową listę słów kluczowych pod kątem SEO, dlatego podzieliliśmy 400 pytań na 5 kategorii (e-commerce, SaaS, wiedza ogólna, wiadomości ze świata oraz poradniki) oraz 3 poziomy długości zapytań – od krótkich i ogólnych po długie i szczegółowe.
Następnie każde pytanie przetestowaliśmy w dwóch wersjach dla każdego rynku: wszędzie w języku angielskim oraz w języku lokalnym danego rynku (po francusku we Francji, po hiszpańsku w Hiszpanii, Argentynie i Stanach Zjednoczonych oraz po japońsku w Japonii). Cztery systemy to: GPT 5.5, Claude Haiku 4.5, Gemini Flash 3.5 oraz Google przeglądy AI Overviews, czyli tryb Google AI we Francji, gdzie w momencie gromadzenia danych usługa przeglądy AI Overviews nie była jeszcze dostępna.
Dla każdej odpowiedzi zarejestrowaliśmy adresy URL źródeł zwrócone przez system. Poniższe dane liczbowe pochodzą z tego surowego zbioru obejmującego ponad 16 000 odpowiedzi.
Największa różnica w działaniu występowała między chatbotami a przeglądy AI Overviews firmy przeglądy AI Overviews, przede wszystkim w sposobie, w jaki każde z tych narzędzi podaje źródła.
Chatboty rzadko odwołują się do źródeł w przypadku krótkich, ogólnych pytań. Jednak im bardziej pytanie staje się konkretne, tym częściej je cytują. Na przykład Claude podaje średnio 0,12 źródła w przypadku krótkiego zapytania i 2,96 w przypadku długiego; ChatGPT przechodzi od 0,09 do 2,26. Gemini cytuje znacznie częściej w każdym przypadku, zwiększając liczbę źródeł z około 1,7 w przypadku krótkich zapytań do około 6,5 w przypadku długich. Jeśli zależy Ci na widoczności w wynikach wyszukiwania opartych na sztucznej inteligencji (a skoro to czytasz, to prawdopodobnie tak jest), optymalizacja treści pod kątem konkretnych, długich zapytań prawdopodobnie zwiększy Twoje szanse na to, że zostaniesz zacytowany.
Jednak przeglądy AI Overviews odwrotnie. Najwięcej źródeł podają w przypadku krótkich, ogólnych zapytań (około 6 źródeł w każdym przypadku), a ich liczba maleje wraz z wydłużaniem się i zwiększaniem konkretności zapytania (do około 4). Tak właśnie zachowuje się strona wyników wyszukiwania, a nie chatbot: krótkie zapytania generują szeroki wachlarz linków, a im bardziej precyzyjne pytanie, tym bardziej zawężona jest odpowiedź.
Oto porównanie trzech chatbotów pod względem średniej liczby cytowanych źródeł na jedno zapytanie:
Chatboty odpowiadają na ogólne pytania, opierając się na posiadanej wiedzy, i sięgają do źródeł dopiero wtedy, gdy zapytanie staje się konkretne, podczas gdy przeglądy AI Overviews linki tak samo jak wyszukiwarka.
W wielu interfejsach opartych na sztucznej inteligencji użytkownik widzi pisemną odpowiedź, a nie listę linków. Dlatego firmy wymienione przez asystenta w treści odpowiedzi mogą mieć równie duże znaczenie, co podane przez niego adresy URL. Policzyliśmy, ile różnych firm każdy chatbot wymienił w odpowiedzi na jedno zapytanie. (W niniejszym przeglądy AI Overviews Google, ponieważ udało nam się zebrać cytowane przez nie linki, ale nie sam tekst odpowiedzi).
Średnia liczba firm wymienionych w jednym zapytaniu, w podziale na chatboty i długość zapytania
ChatGPT i Gemini wymieniają kilka firm w odpowiedzi na każde zapytanie, nawet w przypadku krótkich, ogólnych pytań – tych samych, w których nie podają prawie żadnych adresów URL. Marka może pojawić się w treści odpowiedzi bez ani jednego linku do niej, co oznacza, że liczy się to, czy dana firma jest rozpoznawalna przez te modele, a nie tylko to, czy można do niej zamieścić link.
Temat ma równie duże znaczenie jak długość zapytania. Analizując dane dotyczące chatbotów, można zauważyć, że średnia liczba cytowanych źródeł na jedno pytanie systematycznie rosła w miarę przejścia od tematów ponadczasowych do tematów komercyjnych i szybko zmieniających się.
Ustalone, dobrze udokumentowane tematy, takie jak samouczki i wiedza ogólna, generują najmniej cytowań; modele odpowiadają na nie w dużej mierze na podstawie danych szkoleniowych. Tematy o charakterze komercyjnym i wymagające aktualności, takie jak e-commerce, SaaS i wiadomości ze świata, generują najwięcej cytowań, ponieważ modele poszukują w ich przypadku najświeższych informacji. Dla każdego, kto działa w kategorii komercyjnej, jest to zachęcająca strona tego odkrycia: właśnie w przypadku tych zapytań istnieje szansa na to, by stać się cytowanym źródłem.
W przypadku wszystkich trzech chatbotów zapytania w języku angielskim generowały większą liczbę wyników niż zapytania w językach lokalnych na każdym z badanych przez nas rynków.

Jeśli zadamy to samo pytanie w języku angielskim, systemy te wszędzie sięgają po większą liczbę źródeł niż w przypadku języka lokalnego. Treści anglojęzyczne nadal mają strukturalną przewagę pod względem liczby cytowań, co jest zrozumiałe, biorąc pod uwagę, że angielski pozostaje dominującym językiem w Internecie. To, co zmienia się wraz z językiem, to nie to, czy pojawiają się źródła, ale to, które z nich się pojawiają.
{{baner narzędzi}}
Kiedy zadaliśmy te same pytania w języku lokalnym zamiast w języku angielskim, systemy wyraźnie zaczęły kierować się ku lokalnym źródłom w tym języku.
W Japonii 26% wszystkich cytowanych źródeł znajdowało się na domenach japońskich (.jp), gdy pytaliśmy po japońsku, w porównaniu z około 1%, gdy zadawaliśmy te same pytania po angielsku. Jeśli uwzględnimy również strony w języku japońskim na platformach globalnych, w szczególności ja.wikipedia.org i jp.linkedin.com, odsetek ten wzrasta do 35% w porównaniu z 1,3%. Jeśli jednak pójdziemy w drugą stronę i ograniczymy się do japońskich stron rządowych i akademickich (.go.jp i .ac.jp), różnica ta pozostaje znaczna: 4,26% w języku japońskim w porównaniu z 0,13% w języku angielskim.
We Francji zaobserwowano tę samą tendencję. Zapytania w języku francuskim generowały 16% odesłań do domen .fr, w porównaniu z 1,4% w przypadku zapytań w języku angielskim, a po uwzględnieniu zlokalizowanych stron w witrynach globalnych – łącznie 30% odesłań do źródeł francuskojęzycznych. W przypadku francuskich stron rządowych (.gouv.fr) odsetek ten wzrósł z niemal zera w języku angielskim do 1,25% w języku francuskim. Zapytania w języku hiszpańskim w Hiszpanii generowały 7% odesłań do domen .es i 26% do źródeł w języku hiszpańskim, w porównaniu z 1,7% w przypadku zapytań w języku angielskim.
Argentyna stanowiła wyjątek, co odzwierciedla jej kulturę i historię. Tylko 2% odnośników prowadziło do domen .ar, ale aż 23% stanowiły treści w języku hiszpańskim, w porównaniu z 1,1% w języku angielskim. Argentyńscy użytkownicy otrzymują treści w języku hiszpańskim pochodzące z Hiszpanii, Meksyku oraz z dostosowanych do lokalnych potrzeb stron globalnych, ale nie z argentyńskich domen. W tym przypadku zaobserwowaliśmy, że modele kierowały się raczej językiem niż położeniem geograficznym.

Te same pytania, te same tematy, inny język zapytań, a systemy sięgają po inny zestaw źródeł. Krótko mówiąc, treści dostępne wyłącznie w języku angielskim w dużej mierze pozostają poza zbiorem, z którego czerpią te systemy, udzielając odpowiedzi w języku lokalnym. Efekt ten jest najbardziej widoczny w Japonii, na rynku najbardziej oddalonym od języka angielskiego.
Systemy te różnią się również pod względem preferowanych rodzajów źródeł, a tendencja ta utrzymywała się we wszystkich językach, które przetestowaliśmy.

Jak widać w tabeli, każdy system pobiera cytaty ze stron komercyjnych i stron marek, ale pod względem wszystkich pozostałych aspektów zachowania te się różnią.
Na przykład Claude jest zdecydowanie największym zwolennikiem stron komercyjnych i marek – prawie 9 na 10 odwołań dotyczy właśnie ich, a prawie żadne nie odnosi się do mediów. ChatGPT rozkłada swoje odwołania najszerzej (choć różnica nie jest duża), nadal w znacznej mierze faworyzując strony komercyjne i marki, podczas gdy globalne instytucje i media plasują się na dalszych miejscach, osiągając odpowiednio 8,1% i 9,9%.
przeglądy AI Overviews serwisu Gemini oraz Google przeglądy AI Overviews w znacznym stopniu na źródłach społecznościowych i materiałach wideo: same serwisy YouTube i Reddit stanowiły 21,5% cytatów w serwisie Gemini oraz 29,8% cytatów w przeglądy AI Overviews.
Jeśli chcesz, by Twoje treści zostały zacytowane przez Gemini lub w przeglądzie poświęconym sztucznej inteligencji, największe znaczenie będzie miała silna obecność na YouTube i Reddicie. Jeśli Twoim celem są ChatGPT i Claude, większe znaczenie będą miały Twoje własne strony wizerunkowe oraz artykuły w renomowanych publikacjach.
Średnie opisują rozkład cytowań. Konkretne nazwy wskazują, kto zajmuje tę przestrzeń. Wyodrębniliśmy domeny i firmy, które każdy z chatbotów cytował najczęściej w ramach każdej kategorii tematycznej, po wykluczeniu każdej firmy z zapytań, w których została ona bezpośrednio wymieniona, dzięki czemu dane te odzwierciedlają to, do czego modele doszły samodzielnie. Te dwie tabele obejmują wszystkie trzy chatboty.
Najczęściej cytowane domeny (3 najlepsze w każdej kategorii)
W tym przypadku widać wyraźny podział.
Gemini skupia swoje cytowania na niewielkiej grupie platform, przy czym YouTube i Reddit zajmują czołowe miejsca w niemal każdej kategorii.
Z kolei ChatGPT i Claude czerpią informacje z wielu autorytatywnych źródeł poświęconych konkretnym kategoriom: serwisów z recenzjami sprzętu, takich jak Tom’s Guide i TechRadar, w przypadku handlu elektronicznego, oraz serwisów badawczych i encyklopedycznych, takich jak arXiv, PubMed i Wikipedia, w przypadku wiedzy ogólnej i wiadomości.
Najwięcej cytowań dotyczą sektory e-commerce i SaaS, a wyniki w tych obszarach są najbardziej stabilne; w przypadku kategorii wiedzy ogólnej liczba cytowań jest niewielka, dlatego pozycje te należy traktować jako orientacyjne.
Najczęściej cytowane firmy (3 najlepsze w każdej kategorii)
HubSpot zajmuje pierwsze miejsce w kategorii SaaS pod względem wszystkich trzech chatbotów, a tuż za nim plasuje się Salesforce – co stanowi rzadki przypadek zgodności wyników dla wszystkich modeli – natomiast w sektorze e-commerce dominują marki sprzętu konsumenckiego, takie jak Logitech, Razer i Anker.
To jednak niewielka przewaga: udział HubSpot w rynku SaaS wynosi poniżej 3%, więc wzmianki rozkładają się na długi ogon firm. W tym przypadku bycie cytowanym nie polega na wyparciu jednej dominującej marki, jak ma to miejsce w przypadku tradycyjnych trzech pierwszych niebieskich linków w wynikach SEO. Chodzi raczej o to, by w ogóle znaleźć się w tym gronie.
W badaniu analizuje się, gdzie systemy te szukają informacji, a nie to, jak powinno działać poszczególne źródło. Dane wskazują, że systemy oparte na sztucznej inteligencji lokalizują swoje źródła: jeśli zadamy pytanie w danym języku, preferują one źródła w tym języku.
Dla marki rozszerzającej swoją działalność za granicą oznacza to, że kwestia treści w języku lokalnym nabiera nowego znaczenia. Mówiąc prościej, treści w języku ojczystym danego rynku można przytoczyć, gdy lokalny użytkownik zadaje pytanie. Jeśli jednak istnieją one wyłącznie w języku angielskim, w większości przypadków nie można się na nie powołać. Jest to zjawisko, które obserwowaliśmy już z innej perspektywy w naszych wcześniejszych badaniach dotyczących tłumaczeń i widoczności w sztucznej inteligencji, a niniejsze badanie pomaga wyjaśnić mechanizm leżący u jego podstaw.
Jeśli chcesz, aby Twoje treści mogły być wyświetlane w wynikach wyszukiwania w języku użytkowników, możesz rozpocząć bezpłatny okres próbny serwisu Weglot i uruchomić wielojęzyczną stronę w ciągu kilku minut.
Najlepszym sposobem, by zrozumieć możliwości serwisu Weglot , jest przekonanie się o tym na własne oczy. Wypróbuj go za darmo i bez żadnych zobowiązań.
Jeśli nie jesteś jeszcze gotowy, by podłączyć swoją stronę internetową, w panelu użytkownika dostępna jest strona demonstracyjna.

Tak. W naszym badaniu zadanie tego samego pytania w języku lokalnym zamiast w języku angielskim spowodowało, że znaczna część odnośników została przekierowana do lokalnych domen w tym języku, co było szczególnie widoczne w przypadku języka japońskiego.

Wśród chatbotów Gemini najczęściej pojawiało się w wynikach. przeglądy AI Overviews Google przeglądy AI Overviews często przeglądy AI Overviews dotyczące krótkich, ogólnych zapytań, a rzadziej tych konkretnych – co stanowi odwrotność zachowania chatbotów.

Tak. Tematy o ponadczasowym charakterze, takie jak poradniki i wiedza ogólna, cieszyły się najmniejszą popularnością, podczas gdy tematy o charakterze komercyjnym i aktualnym, takie jak e-commerce, SaaS i wiadomości ze świata, cieszyły się największym zainteresowaniem.

Nie. przeglądy AI Overviews Gemini i Google przeglądy AI Overviews w dużej mierze na serwisach YouTube i Reddit, podczas gdy ChatGPT i Claude czerpały znacznie więcej informacji ze stron marek, serwisów redakcyjnych i instytucji.

Największe znaczenie ma zasięg językowy. Wyszukiwarki oparte na sztucznej inteligencji nadają priorytet źródłom zgodnym z językiem zapytania, więc treści dostępne wyłącznie w języku angielskim rzadko są cytowane w innych językach; w naszej analizie obejmującej 1,3 miliona cytowań przetłumaczone strony internetowe zyskały o 327% większą widoczność w wynikach wyszukiwania typu „ przeglądy AI Overviews ” niż strony jednokierunkowe.
Następnie zadbaj o to, by każda wersja językowa była łatwa do znalezienia i cytowania: przypisz jej dedykowany adres URL, tagi hreflang oraz przetłumaczone metadane, a także dbaj o synchronizację tłumaczeń w miarę aktualizacji treści. Serwis Weglot automatycznie zajmuje się tą stroną techniczną.
Aby zapoznać się z pełnym, 5-etapowym procesem, przeczytaj nasz wielojęzyczny przewodnik GEO.