---
title: "nosnippet na polskich stronach: prawie nikt go nie używa"
description: "Tylko 7 z 7785 polskich stron głównych ogranicza fragment w Google, a co czwarta prosi o większe podglądy. Z 1015 blokujących boty AI nosnippet nie ma żadna."
canonical_url: "https://www.outofplace.space/pl/blog/nosnippet-na-polskich-stronach"
language: "pl"
last_updated: "2026-10-10"
alternates:
  en: "https://www.outofplace.space/blog/snippet-controls-polish-web.md"
---

# nosnippet na polskich stronach: prawie nikt go nie używa

> Tylko 7 z 7785 polskich stron głównych ogranicza fragment w Google, a co czwarta prosi o większe podglądy. Z 1015 blokujących boty AI nosnippet nie ma żadna.

Opublikowano 2026-10-10 · Kategoria: Wyszukiwanie i AI · Tagi: Meta robots, AI Overviews, boty AI, Polska

Prawie żadna polska strona nie używa `nosnippet` ani innej reguły, która ogranicza, co Google i odpowiedzi AI mogą z niej zacytować. Przeczytaliśmy strony główne 7785 serwisów .pl z [listy Tranco najpopularniejszych stron](https://tranco-list.eu/list/Y8YYG/full), które odpowiedziały HTML-em, i tylko 7 ogranicza swój fragment tekstu. O coś odwrotnego prosi znacznie więcej: 25% mówi Google, że może pokazywać duże podglądy obrazów, fragmenty dowolnej długości albo jedno i drugie, zwykle dlatego, że tak domyślnie wpisuje WordPress albo wtyczka SEO.

To strona, której nie widać w [naszym badaniu botów AI w polskim internecie](https://www.outofplace.space/pl/blog/boty-ai-polski-internet). robots.txt decyduje, które boty mogą pobrać stronę; reguły fragmentów decydują, co wyszukiwarka może pokazać ze strony, którą już ma, a Google pisze, że `nosnippet` trzyma tekst strony także z dala od AI Overviews i trybu AI. Strony, które blokują boty AI w robots.txt, z niego nie korzystają: spośród 1015 stron głównych, których robots.txt blokuje bota AI do trenowania, fragment ogranicza 0.

- Tylko 7 z 7785 stron głównych .pl ogranicza fragment tekstu w Google przez `nosnippet` albo `max-snippet`; jakikolwiek podgląd ogranicza 19.
- 25% prosi Google o więcej: duże podglądy obrazów, fragmenty bez limitu albo jedno i drugie. Na stronach z Yoast SEO to 96%.
- `noai` nie ma w żadnym tagu meta. Wszystkie 22 nagłówki z `noai` wysyłają sklepy jednej platformy, AtomStore.
- Żadna z 1015 stron, które blokują bota AI do trenowania w robots.txt, nie ogranicza fragmentu; jeśli sięgają po kontrolę AI na stronie, to po `noarchive` i `nocache` Binga, `data-nosnippet` albo `noai`.

## Co robią nosnippet, max-snippet i max-image-preview

Wyszukiwarki czytają reguły strony z tagu ` ` w HTML albo z nagłówka `X-Robots-Tag` w odpowiedzi serwera. Tag o nazwie `googlebot` albo `bingbot` mówi tylko do jednego bota. Większość znanych reguł decyduje, czy strona trafi do indeksu (`noindex`) i czy jej linki będą śledzone (`nofollow`). Druga grupa decyduje, ile z zaindeksowanej strony wyszukiwarka może pokazać. [Dokumentacja tagu meta robots w Google](https://developers.google.com/search/docs/crawling-indexing/robots-meta-tag?hl=pl) (ostatnia zmiana 24 marca 2026) wymienia je tak:

- `nosnippet`: bez fragmentu tekstu i podglądu wideo. Dotyczy wszystkich rodzajów wyników, także AI Overviews i trybu AI, i sprawia, że treść nie jest bezpośrednim źródłem dla AI Overviews i trybu AI.
- `max-snippet:[liczba]`: najwyżej tyle znaków tekstu; `0` znaczy to samo co `nosnippet`, `-1` zostawia wybór Google.
- `max-image-preview:none|standard|large`: bez podglądu obrazu, podgląd domyślnej wielkości albo szeroki na cały ekran.
- `max-video-preview:[liczba]`: najwyżej tyle sekund podglądu wideo.
- `data-nosnippet`: atrybut HTML, który wyłącza z fragmentów jedną część strony.

Gdy reguły są sprzeczne, Google stosuje bardziej restrykcyjną. Bing nadał dwóm starszym regułom znaczenie dla swoich odpowiedzi AI, a trzecia rodzina, `noai` i `noimageai`, nie ma za sobą żadnego standardu. Przeczytaliśmy je wszystkie na każdej stronie głównej.

## Co czwarta polska strona prosi Google o więcej

Tag meta robots ma w ogóle nieco ponad połowa stron głównych (54%), a wiele z nich mówi tylko `index, follow`, czyli to, co wyszukiwarki i tak zakładają. Spośród reguł w tagach meta i nagłówku, które zmieniają to, co pokazuje Google, wszystkie popularne je poszerzają. Każda z tych reguł, która by je zawężała, występuje na mniej niż jednej stronie głównej na pięćdziesiąt; atrybutem `data-nosnippet`, który działa wewnątrz strony, zajmujemy się dalej.

**Polskie strony proszą Google o większe podglądy, prawie nigdy o mniejsze** (Udział stron głównych .pl z daną regułą w tagu meta albo nagłówku X-Robots-Tag · reguły poszerzające to, co pokazuje Google, w zimnych barwach, ograniczające w ciepłych · n = 7785 · przedziały 95%)

| Pozycja | Wartość | Przedział 95% | n |
| --- | --- | --- | --- |
| max-image-preview:large | 25% | 24%–26% | 7785 |
| max-snippet:-1 | 17% | 17%–18% | 7785 |
| max-video-preview:-1 | 17% | 16%–18% | 7785 |
| noarchive | 1,6% | 1,3%–1,9% | 7785 |
| noindex | 1,1% | 0,9%–1,4% | 7785 |
| noai | 0,3% | 0,2%–0,4% | 7785 |
| nocache | 0,2% | 0,1%–0,4% | 7785 |
| max-image-preview:standard | 0,1% | 0,1%–0,3% | 7785 |
| max-snippet:n | 0,1% | 0%–0,1% | 7785 |
| nosnippet | 0% | 0%–0,1% | 7785 |
| max-snippet:0 | 0% | 0%–0,1% | 7785 |
| max-image-preview:none | 0% | 0%–0,1% | 7785 |
| noimageai | 0% | 0%–0,1% | 7785 |

Source: Spis Outofplace, 24 wrz 2026; lista Tranco Y8YYG. Chart: https://www.outofplace.space/data/blog/snippet-controls-polish-web/charts/pl/chart-polskie-strony-prosza-google-o-wieksze-podglady-prawie-nigdy-o-m.png Data: https://www.outofplace.space/data/blog/snippet-controls-polish-web/2026-09-24/rules.csv

Razem jakikolwiek podgląd, tekstu, obrazu albo wideo, ogranicza 19 stron głównych, a tekst 7, przez `nosnippet` albo `max-snippet` z długością. Kolejne 84 ma `noindex`, który Google by zastosował, i w ogóle nie trafia do wyników. Te liczby to reguły, których posłuchałby Google; wykres i tabela na końcu liczą każdą wzmiankę, także w tagach dla innych botów.

## Skąd się bierze max-image-preview:large

`max-image-preview:large` to ustawienie domyślne najpopularniejszego oprogramowania. [WordPress 5.7](https://make.wordpress.org/core/2021/02/19/robots-api-and-max-image-preview-directive-in-wordpress-5-7/) (marzec 2021) dodaje tę regułę każdej stronie, która pozwala się indeksować, a według [specyfikacji Yoast SEO](https://developer.yoast.com/features/seo-tags/meta-robots/functional-specification/) wtyczka domyślnie wpisuje `max-snippet:-1, max-image-preview:large, max-video-preview:-1` na każdej publicznej stronie. W spisie widać te ustawienia domyślne: udział stron proszących o duże podglądy rośnie i spada razem z oprogramowaniem, na którym stoi strona.

**Duże podglądy obrazów idą za oprogramowaniem strony** (Co strony główne .pl mówią Google o podglądach obrazów, według wtyczki SEO albo CMS-a · Yoast n = 907, Rank Math n = 239, All in One SEO n = 100, inny WordPress n = 591, nie WordPress n = 5948)

| Pozycja | Ograniczony (standard lub none) | Bez reguły (domyślny rozmiar) | Prośba o duże podglądy | n |
| --- | --- | --- | --- | --- |
| Yoast SEO | 0,1% | 4% | 96% | 907 |
| Rank Math | 0% | 5,4% | 95% | 239 |
| All in One SEO | 0% | 10% | 90% | 100 |
| Inny WordPress | 0,5% | 33% | 66% | 591 |
| Nie WordPress | 0,1% | 94% | 6% | 5948 |

Source: Spis Outofplace, 24 wrz 2026. Chart: https://www.outofplace.space/data/blog/snippet-controls-polish-web/charts/pl/chart-duze-podglady-obrazow-ida-za-oprogramowaniem-strony.png Data: https://www.outofplace.space/data/blog/snippet-controls-polish-web/2026-09-24/software.csv

Dziewięć na dziesięć lub więcej stron głównych z Yoast SEO, Rank Math albo All in One SEO prosi o duże podglądy. Pozostałe strony na WordPressie robią to rzadziej, 66%, może dlatego, że część wyłącza ustawienie domyślne albo ma motyw, który wypisuje własny tag; poza WordPressem 6%. Spośród wszystkich stron głównych proszących o duże podglądy 61% ma wtyczkę SEO, którą rozpoznajemy.

To rozsądne ustawienie dla strony, która chce, żeby jej zdjęcia było widać. Oznacza jednak, że większość próśb o większe podglądy pokrywa się z tym, co oprogramowanie wpisuje domyślnie, a o odwrotność, ograniczenie tego, co widać, prawie nikt nie prosi.

## noai: nagłówek jednej platformy sklepów

`noai` i `noimageai` to nieoficjalne reguły, które proszą usługi AI, by nie używały tekstu albo obrazów strony. Nie ma ich wśród reguł w dokumentacji Google. W spisie nie ma ich w żadnym tagu meta. Wszystkie to nagłówki `X-Robots-Tag: noai` i wszystkie wysyłają sklepy na AtomStore: 22 z 36 sklepów AtomStore w naszej próbie, co wskazuje raczej na ustawienie platformy niż na osobne decyzje.

## noarchive i nocache: przełączniki Binga dla odpowiedzi AI

We wrześniu 2023 Bing ogłosił [nowe opcje kontroli użycia treści w Bing Chat](https://blogs.bing.com/webmaster/september-2023/Announcing-new-options-for-webmasters-to-control-usage-of-their-content-in-Bing-Chat), według których dwie stare reguły sterują teraz jego AI: treść z `noarchive` nie trafi do odpowiedzi Bing Chat ani do trenowania modeli Microsoftu, a przy `nocache` Bing pokaże tylko adres, tytuł i fragment. Dwa miesiące później Microsoft [przemianował Bing Chat na Copilota na Ignite 2023](https://blogs.microsoft.com/blog/2023/11/15/microsoft-ignite-2023-ai-transformation-and-the-technology-driving-change/). Wyszukiwarka Google z kolei [`noarchive` już nie używa](https://developers.google.com/search/docs/crawling-indexing/robots-meta-tag?hl=pl#noarchive), odkąd zrezygnowała z kopii stron w pamięci podręcznej.

101 polskich stron głównych daje Bingowi `noarchive`, a 17 `nocache`, razem 1,5%. To reguły, których posłuchałby Bing, a strona z obiema liczy się jako `nocache`, więc liczby różnią się od tabeli, która liczy każdą wzmiankę. Czy chciały trzymać się z dala od Copilota, czy zostawiły regułę z czasów kopii stron w Google, z samego tagu nie wiadomo.

## Co robi data-nosnippet?

`data-nosnippet` chowa przed fragmentami jedną część strony, a reszta zostaje do cytowania: zastrzeżenie, zmieniającą się cenę, blok stałego tekstu. Google czyta go tylko na elementach `span`, `div` i `section`. Używa go 4,6% polskich stron głównych, więcej niż wszystkich pozostałych reguł ograniczających razem, ale głównie nie na treści.

Spośród stron głównych z `data-nosnippet` 64% ma go na banerze cookies. Większość tych banerów pochodzi z dwóch wtyczek WordPressa z [naszego badania narzędzi do zgody na cookies](https://www.outofplace.space/pl/blog/baner-cookies-na-polskich-stronach): Complianz, na 64% z nich, i Cookie Law Info, na 28%. Oznaczają swoje banery, żeby „Używamy plików cookies” nigdy nie stało się opisem strony w Google.

Na treści atrybut pojawia się na 1,7% stron głównych, a 9% stron, które go używają, stawia go na elemencie innym niż `span`, `div` czy `section`, gdzie Google go nie czyta.

## robots.txt mówi botom AI „nie”, strona nie mówi nic

robots.txt i reguły fragmentów robią co innego. Zablokowanie GPTBota albo ClaudeBota w robots.txt sprawia, że te boty nie pobierają strony. Nie zmienia nic w AI Overviews, które powstają z indeksu Googlebota, a [lista botów Google](https://developers.google.com/crawling/docs/crawlers-fetchers/google-common-crawlers?hl=pl) mówi, że Google-Extended, token dla Gemini, nie wpływa na obecność strony w wyszukiwarce Google (stan na 9 października 2026). Na AI Overviews i tryb AI strona ma dwie dźwignie: samego Googlebota i reguły fragmentów.

Puściliśmy po spisie te same reguły co w badaniu botów AI: robots.txt 13% stron głównych blokuje co najmniej jednego bota AI do trenowania, a 228 blokuje Google-Extended. Żadna z nich nie ogranicza fragmentu. Limity fragmentu są jednak tak rzadkie, że to zero nie odróżnia blokujących od nikogo: wśród pozostałych stron głównych ogranicza go tylko 7. Pokazuje za to, że blokada botów AI w robots.txt nie idzie w parze z regułą fragmentu na stronie.

**Strony, które blokują boty AI w robots.txt, nie ograniczają też fragmentów** (Udział stron głównych .pl z daną kontrolą na stronie, według tego, czy ich robots.txt blokuje bota AI do trenowania · blokuje n = 1015, nie blokuje n = 6770)

| Pozycja | robots.txt blokuje bota AI do trenowania | robots.txt nie blokuje żadnego |
| --- | --- | --- |
| Limit fragmentu (nosnippet, max-snippet) | 0% | 0,1% |
| noarchive lub nocache (Bing) | 3,5% | 1,2% |
| data-nosnippet na treści | 4,6% | 1,3% |
| noai lub noimageai | 1,8% | 0,1% |
| noindex | 1,6% | 1% |
| Którakolwiek z kontroli AI | 7,5% | 2,7% |

Source: Spis Outofplace, 24 wrz 2026. Chart: https://www.outofplace.space/data/blog/snippet-controls-polish-web/charts/pl/chart-strony-ktore-blokuja-boty-ai-w-robots-txt-nie-ograniczaja-tez-fr.png Data: https://www.outofplace.space/data/blog/snippet-controls-polish-web/2026-09-24/robots_txt.csv

Strony blokujące boty AI częściej niż reszta używają jakiejś kontroli AI na stronie, 7,5% wobec 2,7%, ale różnicę robią `data-nosnippet`, `noarchive` i `nocache` Binga oraz `noai` od AtomStore, które 18 wysyłających go sklepów łączy z blokadą botów AI w robots.txt. Jedynej reguły, którą Google wskazuje dla AI Overviews, nie ma żadna z nich.

## Jak ograniczyć, co cytują Google i odpowiedzi AI

Reguła fragmentu to wymiana. `nosnippet` trzyma tekst strony z dala od AI Overviews, ale też spod jej niebieskiego linku w zwykłych wynikach, co zwykle kosztuje kliknięcia. Decyduj dla każdej strony osobno, nie dla całego serwisu.

Otwórz źródło strony i poszukaj `name="robots"`, potem w panelu sieci przeglądarki sprawdź nagłówki odpowiedzi pod kątem `X-Robots-Tag`. Jeśli masz WordPressa z Yoast albo Rank Math, najpewniej znajdziesz `max-image-preview:large, max-snippet:-1`: poprosiłeś o więcej, nie o mniej.

Na stronie, której tekstu nie chcesz w cytatach, ustaw regułę w nagłówku dokumentu. `max-snippet` zostawia krótki fragment; `nosnippet` go usuwa:

```html title="head"

<!-- albo, żeby trzymać tekst z dala od fragmentów i AI Overviews -->

```

Otocz akapit albo blok elementem `div`, `span` albo `section` z atrybutem; inne elementy Google pomija:

```html
 Ceny zmieniają się codziennie; sprawdź stronę produktu.
```

PDF-y i obrazy nie mają nagłówka HTML, więc ich reguły idą w nagłówku HTTP. W nginx:

```nginx title="nginx.conf"
location ~* \.pdf$ {
  add_header X-Robots-Tag "nosnippet" always;
}
```

W Apache to samo robi `Header set X-Robots-Tag "nosnippet"` w bloku ` `.

`noarchive` trzyma stronę z dala od odpowiedzi AI Binga; `nocache` pozwala mu pokazać w nich tylko adres, tytuł i fragment. Żadna z nich nie działa na Google.

Bot zablokowany w robots.txt nigdy nie przeczyta reguł samej strony. Żeby trzymać tekst strony z dala od AI Overviews, pozwól Googlebotowi ją pobrać i powiedz mu `nosnippet`.

## Jak mierzyliśmy

Strony główne pochodzą z naszego spisu z 24 września 2026, zrobionego przez `OutofplaceResearchBot` (zobacz, [co pobiera nasz bot i jak go zablokować](https://www.outofplace.space/pl/bot)), który najpierw czyta robots.txt i pobiera tylko stronę główną: HTML-em odpowiedziało 8023 z 9208 domen .pl z listy Tranco, a po złączeniu domen przekierowujących pod ten sam adres zostało 7785 różnych serwisów.

Z każdej strony głównej przeczytaliśmy wszystkie tagi meta robots (`robots` i tagi nazwane od bota, np. `googlebot` albo `bingbot`) i nagłówek `X-Robots-Tag` ostatniej odpowiedzi, bez uruchamiania skryptów. Połączyliśmy je tak, jak opisuje dokumentacja Google: tagi i reguły nagłówka dla wszystkich botów albo dla Googlebota, przy czym wygrywa bardziej restrykcyjna reguła. Widok Binga bierze tagi i reguły nagłówka dla wszystkich botów, Bingbota albo msnbota. `noai` i `noimageai` liczą się wszędzie, gdzie się pojawią. Przy `data-nosnippet` znaleźliśmy każdy element z atrybutem i zaliczaliśmy go do banera cookies, gdy ten element albo element, w którym się znajduje, nazwany jest od cookies albo zgody.

robots.txt pochodzi z tego samego spisu i jest czytany parserem i listą botów z naszego badania botów AI: robots.txt blokuje bota na stronie głównej, gdy zabrania mu `/`, z nazwy albo przez `*`. „Bot AI do trenowania” to każdy z aktualnych botów trenujących z tej listy.

Widzieliśmy tylko stronę główną, tak jak wysłał ją serwer. Artykuły i strony produktów mogą mieć inne reguły (wydawcy często ustawiają je dla każdego artykułu), a reguła dodana przez JavaScript albo wysyłana tylko dla innych ścieżek jest niewidoczna. Strona główna dłuższa niż 1 MiB była w tym miejscu ucięta (331 takich). Czytaliśmy, o co proszą strony; czy Google, Bing i usługi AI się do tego stosują, to deklaracja ich dokumentacji, której nie sprawdzaliśmy. Baner cookies, którego znaczniki nie nazywają cookies ani zgody, liczy się jako treść.

## Dalsza lektura

- [Specyfikacje tagu meta robots, data-nosnippet i X-Robots-Tag](https://developers.google.com/search/docs/crawling-indexing/robots-meta-tag?hl=pl): Dokumentacja Google wszystkich reguł fragmentów i indeksowania, z tym, jak nosnippet działa na AI Overviews i tryb AI.

- [Bing: nowe opcje kontroli użycia treści w Bing Chat](https://blogs.bing.com/webmaster/september-2023/Announcing-new-options-for-webmasters-to-control-usage-of-their-content-in-Bing-Chat): Ogłoszenie Binga o tym, co noarchive i nocache znaczą dla jego odpowiedzi AI i trenowania modeli, wrzesień 2023 (po angielsku).

- [Popularne roboty Google](https://developers.google.com/crawling/docs/crawlers-fetchers/google-common-crawlers?hl=pl): Lista botów i tokenów Google, z tym, czym steruje Google-Extended, a czym nie.

- [Boty AI kontra polski internet: robots.txt 1000 stron .pl](https://www.outofplace.space/pl/blog/boty-ai-polski-internet): Nasze badanie robots.txt największych stron .pl: które boty AI blokują i jak.
