Odtajniona 17 września wersja pozwu o wydanie wyroku w trybie uproszczonym w sprawie The New York Times przeciwko OpenAI i Microsoftowi zawiera dane, których branża SEO nie widziała nigdy wcześniej: wewnętrzne pomiary Microsoftu pokazują, że Copilot w Bing obcinał współczynnik klikalności do serwisów wydawców o 51–94 proc. w porównaniu z klasycznymi wynikami wyszukiwania. W tych samych dokumentach szef ChatGPT nazywa produkt OpenAI „w dużej mierze substytucyjnym”, a dyrektor naukowy Microsoftu opisuje praktyki treningowe jako „największą kradzież pracy w historii ludzkości”. Jak podaje serwis PPC Land, który przeanalizował dokument o sygnaturze 1977-1 w aktach sprawy, to pierwsza twarda liczba na temat tego, ile ruchu naprawdę zabiera wydawcom odpowiedź AI wpięta w wyszukiwarkę.
Kontekst: proces, który ciągnie się od grudnia 2023
The New York Times pozwał OpenAI i Microsoft pod koniec 2023 roku, zarzucając obu firmom masowe kopiowanie artykułów do treningu modeli GPT oraz odtwarzanie ich treści w odpowiedziach ChatGPT i Copilota. Sprawa została później połączona z pozwami innych wydawców w postępowanie wielookręgowe (MDL 25-md-3143) przed sędzią Sidneyem H. Steinem z sądu federalnego dla południowego dystryktu Nowego Jorku. Po stronie powodów są dziś: The New York Times Company, osiem tytułów grupy Daily News (m.in. Chicago Tribune, Denver Post i Orlando Sentinel), Ziff Davis, Center for Investigative Reporting oraz The Intercept.
4 września obie strony złożyły wnioski o rozstrzygnięcie sprawy bez ławy przysięgłych. Wersje z 4 września były mocno zaczernione. 17 września do akt trafiła wersja publiczna, w której zniknęła większość utajnień dotyczących wewnętrznych analiz Microsoftu i korespondencji pracowników OpenAI. Właśnie tę wersję opisują teraz serwisy branżowe po obu stronach Atlantyku, a w Polsce wciąż mało kto zwrócił uwagę, że są w niej dane bezpośrednio dotyczące SEO.
Kluczowe fakty z odtajnionych dokumentów
Najważniejsza dla branży wyszukiwania część dotyczy pomiaru substytucji. Microsoft porównał, jak często użytkownicy klikają w link do serwisu wydawcy, gdy widzą go w klasycznym wyniku Bing, a jak często, gdy ten sam serwis pojawia się jako źródło w odpowiedzi Copilota. Wyniki, wedle doniesień PPC Land, wyglądają następująco:
| Wydawca | Spadek CTR w Copilot vs klasyczny Bing |
|---|---|
| The New York Times | 87–93 proc. |
| Tytuły Daily News | 83–91 proc. |
| Ziff Davis (m.in. PCMag, IGN) | 51–94 proc. |
Do tego dochodzą inne liczby, które powodowie zebrali z różnych źródeł i wpisali do jednego wniosku:
- 87,78 proc. sesji w ChatGPT kończy się bez wejścia na żadną zewnętrzną stronę. Dla Google ten sam wskaźnik wynosi 26,91 proc.
- Stosunek crawlingu do odesłań u OpenAI to według danych Cloudflare z maja 2025 roku 1500 pobrań strony na jedno odesłane wejście. Dla Google ten stosunek wzrósł z 2:1 w 2015 roku do 18:1 w czerwcu 2025.
- 36 proc. subskrybentów The New York Times, którzy używają ChatGPT do śledzenia wiadomości, deklaruje, że „nie potrzebuje już w ogóle wiadomości z NYT”.
- Miesięczne odesłania z Google Discover do wydawców spadły z ponad 5 miliardów do poniżej 4 miliardów, a z wyszukiwarki Google z ponad 3 miliardów do nieco ponad 2 miliardów od startu AI Overviews.
- Ekonomista powołany przez OpenAI, dr Avi Goldfarb, przyznał w opinii, że AI Overviews „mogły obniżyć odesłania z wyszukiwarki o 20 do 60 proc.”.
- Randomizowane badanie z lipca 2026 roku, cytowane we wniosku, wykazało 39,8 proc. mniej kliknięć w wynikach z widocznym podsumowaniem AI.
Osobny wątek to skala kopiowania. Według powodów zbiory treningowe zawierały 3 924 653 kopie artykułów NYT (944 655 unikalnych tekstów), 7 387 394 kopie z tytułów Daily News i 6 271 629 kopii z Ziff Davis. W 99,9 proc. kopii NYT usunięto notę o prawach autorskich, co ma znaczenie dla roszczeń z ustawy DMCA. Dokumenty wymieniają też narzędzia do ekstrakcji tekstu (Dragnet, Newspaper, Gutentag), które automatycznie odcinały bylines i symbole copyright.
Co mówili menedżerowie OpenAI i Microsoftu
Największy rezonans medialny wywołały cytaty. Dr Brent Hecht, dyrektor ds. nauk stosowanych w Microsofcie, w wewnętrznej notatce określił praktykę treningową jako „zdumiewającą kradzież o bezprecedensowej skali” i „największą kradzież pracy w historii ludzkości”. Dodał, że wygrana na gruncie fair use „zrobiłaby z tej doktryny kompletną kpinę”. W innym niedatowanym dokumencie Microsoftu pada zdanie: „Nasza strategia treści AI uruchomiła pętlę zagłady (doom loop), która zaszkodzi wydajności naszych modeli i całej sieci”. I obok: „LLM to produkt, który niszczy własny łańcuch dostaw”.
Satya Nadella, prezes Microsoftu, zeznał podczas przesłuchania, że chatboty „zastąpiły” wizytę u źródła, bo „podają informację od razu na platformie AI zamiast wymagać przejścia do serwisu bazowego”. Stwierdził też, że „wszystko, co jest za paywallem, powinno być licencjonowane przez każdego, kto chce z tego korzystać”, a gdyby wiedział o pobieraniu treści zza paywalli, skorzystałby z prawa do zażądania ponownego wytrenowania modeli OpenAI.
Po stronie OpenAI najmocniej wybrzmiały słowa Nicka Turleya, szefa ChatGPT: wydawcy stoją przed „egzystencjalnym zagrożeniem”, produkty firmy „są w dużej mierze substytucyjne, kropka” i „będą coraz bardziej substytucyjne”. Anonimowy inżynier OpenAI dopisał: „Niezależnie od tego, jak wyraźnie pokażemy linki, użytkownicy nie będą klikać”. Greg Brockman, współzałożyciel i prezes OpenAI, w wiadomości o modelu napisał, że firma jest „świetna w newsach”, bo model dokańcza zdania z artykułów NYT „bardzo trafnie”, a na wzmiankę kolegi o „hacku na paywall nytimes” odpowiedział krótko: „Ah nice”.
Dokumenty pokazują też wewnętrzną chronologię świadomości ryzyka w OpenAI: w listopadzie 2019 roku pracownicy obawiali się „przypadkowego odtwarzania utworów chronionych”, w czerwcu 2022 roku pisali, że GPT-4 „zapamięta tonę danych i będzie szalenie dobry w regurgitacji”, w marcu 2023 zauważyli, że ChatGPT może „dostać się do treści” za paywallami, a w czerwcu 2023 firma uznała, że stanowi „egzystencjalne zagrożenie” dla wydawców.
Bing jako dostawca danych: Project Taxi i Project Mango
Dla osób zajmujących się technicznym SEO równie ciekawy jest wątek, jak indeks wyszukiwarki stał się zbiorem treningowym. Z dokumentów wynika, że w latach 2019–2022 Microsoft w ramach „Project Taxi” przekazał OpenAI indeks Bing obejmujący miliardy stron. Ówczesny dyrektor badawczy OpenAI Bob McGrew opisał to w październiku 2021 roku jako „wymianę danych”: „my dajemy dane im, oni dają dane nam”. Osobny „Project Mango” to crawler prowadzony przez Microsoft, który zbierał dokumenty pod trening OpenAI za opłatą (jej wysokość pozostaje utajniona). W samym Project Mango znalazło się co najmniej 160 903 unikalnych utworów powodów.
To ważny sygnał: treści pobrane przez bota wyszukiwarki na potrzeby indeksowania trafiały do zupełnie innego zastosowania, którego nie obejmowała licencja na wyszukiwanie. Rozdzielenie crawlingu wyszukiwarkowego od treningowego to dokładnie ten problem, który próbują dziś rozwiązać Cloudflare, nowe dyrektywy w robots.txt i standardy w rodzaju Content Signals. O tym, jak Cloudflare rozdziela te dwa cele i dlaczego blokada treningu nie blokuje Googlebota, pisaliśmy w tekście o dyrektywie Disallow AI Training.
Wątek groundingu (czyli pobierania stron na żywo do odpowiedzi Copilota) też ma liczby. W co najmniej 2 milionach rozmów Copilot sięgał po treści powodów, w tym po 34 970 unikalnych URL-i NYT i 35 202 URL-i Daily News. W ponad 88 178 przypadkach odpowiedź zawierała co najmniej sześć nienakładających się ciągów 16 słów z artykułu, czyli minimum 96 słów wprost przepisanych. W jednym pomiarze z pojedynczego artykułu pobrano 1820 słów.
Co to znaczy dla SEO i AIO
Do tej pory branża szacowała utratę kliknięć na podstawie własnych paneli Search Console, badań firm zewnętrznych i ogólnych deklaracji platform. Google w lipcu chwalił się „miliardami kliknięć z AI”, ale bez danych do weryfikacji. Teraz mamy pomiar wykonany przez samego operatora wyszukiwarki, na jego własnych logach, dla konkretnych domen. Kilka wniosków nasuwa się od razu.
Widoczność w odpowiedzi AI nie jest zamiennikiem widoczności w wynikach
Spadek CTR rzędu 87–93 proc. dla domeny o autorytecie NYT oznacza, że nawet najsilniejsza marka, cytowana z nazwy w odpowiedzi, dostaje ułamek ruchu, który miałaby z klasycznego wyniku na tej samej pozycji. Jeśli w raportach dla klienta pokazujesz impresje z AI Overviews czy Copilota jako sukces, warto przy nich dopisać przelicznik. Ten sam mechanizm w Google opisaliśmy w analizie spadku kliknięć po AI Overviews i sposobów odzyskania ruchu.
Rozrzut 51–94 proc. wskazuje na typ treści
Najciekawszy jest rozrzut w portfelu Ziff Davis. To grupa, która ma zarówno treści newsowe, jak i recenzje, poradniki i porównania produktów. Spadek 51 proc. na jednym końcu i 94 proc. na drugim sugeruje, że nie każda treść jest równie substytuowalna. Krótkie fakty, definicje i relacje z wydarzeń są konsumowane w całości w odpowiedzi. Treści transakcyjne, narzędziowe i te z własnymi danymi (testy, benchmarki, kalkulatory) bronią kliknięcia lepiej. To praktyczny argument za przesuwaniem budżetu contentowego w stronę formatów, których model nie streści bez straty dla użytkownika.
Bing to nie margines dla planowania AIO
Choć w Polsce Bing ma kilka procent rynku, jego indeks zasila ChatGPT Search, Copilota i część odpowiedzi w Windows. Dokumenty potwierdzają, że sam indeks Bing był fizycznie przekazywany OpenAI, a wcześniejsze analizy pokazują, że ChatGPT wyprzedził już Bing pod względem ruchu w USA. Więcej o tej zmianie układu sił piszemy w materiale ChatGPT wyprzedza Bing i DuckDuckGo. Wniosek dla praktyków: audyt indeksowalności w Bing Webmaster Tools i IndexNow to dziś element strategii pod ChatGPT, a nie fanaberia.
Opt-out działa z opóźnieniem i niekompletnie
Z dokumentów wynika, że OpenAI po raz pierwszy zablokowało serwis jednego z powodów w groundingu we wrześniu 2023 roku, a pozostałe dopiero w styczniu 2025. Wydawcy stosowali się do opublikowanych instrukcji opt-out, a blokada i tak była niepełna. Narzędzie Media Manager, zapowiedziane w 2024 roku jako centralny mechanizm wypisania się, zostało porzucone. To argument, by nie polegać wyłącznie na robots.txt, tylko łączyć go z blokadą na poziomie CDN lub WAF i monitorować logi serwera pod kątem user-agentów GPTBot, ChatGPT-User i OAI-SearchBot.
Reakcje branży
Jak podaje Digiday, Alan Chapell z kancelarii Chapell and Associates ocenia, że przyznanie przez własnych menedżerów, iż produkt jest substytucyjny, „prawdopodobnie eliminuje obronę opartą na fair use”, a obchodzenie paywalli może wypełniać znamiona naruszenia ustawy DMCA z 1998 roku. Danielle Coffey, prezeska News/Media Alliance, wskazuje, że słowa Nadelli o tym, że chatboty dostarczają informację bez konieczności kliknięcia, wprost wzmacniają argument o szkodzie rynkowej, kluczowy w teście fair use.
Prawnicy cytowani anonimowo studzą jednak emocje: w innych sprawach dotyczących AI sądy uznawały trening za zastosowanie transformatywne, a sędzia Vince Chhabria w sprawie Kadrey przeciwko Meta orzekł w 2025 roku na korzyść Mety, choć zaznaczył, że wydawcy „mają jeszcze silniejsze argumenty przeciwko fair use” niż autorzy książek. Warto też pamiętać o rozstrzygnięciu w sprawie autorów przeciwko Anthropic, zakończonej ugodą na 1,5 mld dolarów we wrześniu 2025 roku, która ustaliła pewien punkt odniesienia dla wycen.
Stanowisko obrony z 4 września opiera się na czterech filarach. OpenAI wskazuje, że jego biegły znalazł zaledwie 24 przypadki dosłownego odtworzenia tekstu w próbie 20 milionów logów ChatGPT (0,00012 proc.), że modele uczyły się z szerokiego przekroju internetu, a usuwanie not copyright było ubocznym skutkiem działania ekstraktorów tekstu. Microsoft złożył wniosek o oddalenie wszystkich roszczeń. Obie firmy poprosiły o rozprawę ustną. 3 września Departament Sprawiedliwości USA złożył stanowisko popierające argumentację OpenAI w zakresie fair use.
W dokumentach pojawia się też wątek rynku licencji, istotny dla wyceny szkody. OpenAI ma podpisane umowy z wydawcami (liczba i kwoty utajnione), Microsoft ma porównywalne, Amazon zawarł co najmniej 23 umowy o świadczenie danych, a wśród licencjobiorców wymieniane są Google, Meta, Perplexity, ProRata.ai i Mistral AI. Pośrednikami w tych transakcjach są m.in. TollBit, Cloudflare, ScalePost, Human Native AI i Copyright Clearance Center. To ten sam rynek, w którym Google testuje własny model rozliczeń, opisany przez nas w tekście o pilotażu AI contribution w Search Console. Dla porównania powodowie wyliczyli, że wygenerowanie miliona syntetycznych artykułów po 500 słów kosztuje dziś około 6800 dolarów.
Co dalej
Nie ma jeszcze terminu rozprawy. Sędzia Stein może rozstrzygnąć sprawę w trybie uproszczonym w całości, częściowo albo skierować ją na proces z ławą przysięgłych. Osobno wisi wniosek o sankcje dotyczący roszczeń o grounding i odpowiedzi, wstrzymany do czasu rozstrzygnięcia głównych kwestii. Zespoły prawne będą przez kolejne miesiące spierać się o pozostałe zaczernienia, więc trzeba liczyć się z kolejnymi falami odtajnień, w tym prawdopodobnie kwot z umów licencyjnych i pełnych danych z Project Taxi.
Dla SEO najważniejsze będą trzy rzeczy. Po pierwsze, czy sąd uzna, że pobieranie treści przez crawler wyszukiwarki i użycie ich do treningu to dwa odrębne zastosowania wymagające odrębnych zgód. Taki wyrok zmieniłby sens robots.txt i przyspieszył przyjęcie osobnych dyrektyw dla treningu. Po drugie, czy dane o spadku CTR staną się standardowym dowodem szkody rynkowej. Wtedy każdy wydawca z dostępem do Search Console i Bing Webmaster Tools miałby gotowy szablon roszczenia. Po trzecie, czy rynek licencji zostanie uznany za dojrzały. Jeśli tak, argument „nie było komu zapłacić” przestaje działać, a stawki za dostęp do treści dla modeli wejdą do cenników, tak jak dziś stawki za dane w sieciach reklamowych.
Niezależnie od wyroku, wewnętrzna notatka Microsoftu o „pętli zagłady” trafnie opisuje zależność, z którą i tak musimy pracować: model odpowiada na podstawie treści, na których powstanie nie zarabia. Do czasu, aż rynek albo sąd ustali zasady, najlepszą odpowiedzią po stronie wydawcy pozostaje produkcja treści trudnych do streszczenia i mierzenie ruchu z AI na własnych danych, a nie na deklaracjach platform.
FAQ
Skąd pochodzą dane o spadku CTR o 94 proc.?
Z wewnętrznych analiz Microsoftu ujawnionych w odtajnionej 17 września 2026 roku wersji wniosku powodów o wydanie wyroku w trybie uproszczonym w sprawie MDL 25-md-3143 (The New York Times i inni przeciwko OpenAI i Microsoftowi). Microsoft porównał współczynnik klikalności w klasycznych wynikach Bing z klikalnością tych samych serwisów jako źródeł w odpowiedziach Copilota.
Czy te liczby dotyczą także Google i AI Overviews?
Bezpośrednio nie. Pomiar dotyczy Bing i Copilota. W tym samym wniosku powodowie cytują jednak niezależne szacunki dla Google: opinię biegłego OpenAI o spadku odesłań o 20–60 proc. po wdrożeniu AI Overviews, randomizowane badanie z lipca 2026 roku wskazujące 39,8 proc. mniej kliknięć oraz spadek miesięcznych odesłań z Google Discover z ponad 5 mld do poniżej 4 mld.
Co oznacza określenie „produkt substytucyjny” w kontekście fair use?
W amerykańskim teście fair use jednym z czterech czynników jest wpływ użycia na rynek oryginalnego dzieła. Jeśli produkt oparty na cudzej treści zastępuje tę treść (użytkownik nie musi już wchodzić do źródła), to czynnik ten przemawia przeciwko fair use. Dlatego cytaty menedżerów OpenAI o „substytucyjności” są tak istotne dla powodów.
Jak wydawca w Polsce może wykorzystać te informacje?
Na trzy sposoby: dopisać do raportów przelicznik między impresjami w odpowiedziach AI a realnymi kliknięciami, przesunąć budżet contentowy w stronę formatów trudnych do streszczenia (własne dane, testy, narzędzia) oraz zweryfikować blokady botów AI nie tylko w robots.txt, ale też na poziomie CDN i w logach serwera.
Kiedy zapadnie wyrok?
Nie ma jeszcze terminu. Obie strony złożyły wnioski o rozstrzygnięcie bez ławy przysięgłych 4 września 2026 roku i poprosiły o rozprawę ustną. Sędzia Sidney H. Stein może uwzględnić wnioski w całości, częściowo albo skierować sprawę na pełny proces. Równolegle trwa spór o pozostałe zaczernienia w dokumentach.










