
Praėjusį rugsėjį Lily Ray paklausė Perplexity naujausių SEO ir AI paieškos naujienų. Ji užtikrintai papasakojo jai apie „2025 m. rugsėjo mėn. „Perspektyvos“ pagrindinio algoritmo atnaujinimą“; „Google“ naujinys, kurio, kaip ji tada ilgai rašė „The AI Slop Loop“, nebuvo. „Google“ daugelį metų neįvardijo pagrindinių atnaujinimų. „Perspektyvos“ jau buvo SERP funkcija. Jei tikras atnaujinimas būtų paskelbtas jai būnant Austrijoje, gautieji jai būtų pranešę anksčiau nei Perplexity.
Ji patikrino citatas. Abu atkreipė dėmesį į dirbtinio intelekto sukurtus įrašus SEO agentūrų tinklaraščiuose: svetainėse, kuriose buvo vykdomas turinio srautas, haliucinuojamas atnaujinimas ir paskelbtas pranešimas. Suglumimas perskaitė šlamštą, traktavo jį kaip pirminę medžiagą ir pateikė jai kaip naujieną.
Vasario mėnesį BBC atstovas Thomas Germainas 20 minučių skyrė tinklaraščio įrašą savo asmeninėje svetainėje. Jo pavadinimas: „Geriausi dešrainius valgantys technologijų žurnalistai“. Jame jis buvo pirmas, buvo sukurtas 2026 m. Pietų Dakotos tarptautinis dešrainių čempionatas, kuris niekada neįvyko, ir nieko nenurodyta. Per 24 valandas tiek „Google“ AI apžvalgos, tiek „ChatGPT“ perdavė jo sugalvojimą visiems, kurie paprašė. Klodas neįkando. Tai padarė Google ir OpenAI.
Kiekvienas, kas žiūrėjo, matė.
Aš ginčijausi dėl Ouroboros anksčiau. Neteisinga laiko juosta
Vyrauja šios problemos rėmeliai modelio žlugimas. Jūs mokote modelį naudodami žiniatinklio tekstą, žiniatinklis prisipildo dirbtinio intelekto išvesties, kitas modelis treniruojasi korpuse, kurį vis dažniau sudaro jo paties išmetimo sistemos, ir galiausiai paskirstymas pavirsta į košę. Inovacijos kyla iš išimčių, o tikimybinės sistemos, kurios susilieja su vidurkiu, sumažina išimtis pagal dizainą. Aš pavartojau frazę skaitmeniniai mūsųoborai už tai.
Šis kadravimas apima treniruočių ciklus. Tai reikalauja laiko. Daroma prielaida, kad užterštumas juda modelio išleidimo greičiu.
Taip nėra. Tai, ką dokumentavo Lily, ką Germainas, ką „New York Times“ tada įvertino ir kiekybiškai įvertino – tai nėra mokymo pusė. Dalyvaujantys modeliai nebuvo perkvalifikuoti nuo haliucinacijų atsiradimo dienoraštyje iki to, kad ji buvo pateikta kaip citatomis paremtas faktas. Užteršimas judėjo šliaužimo greičiu. Ouroboros nereikalauja kartų, kad galėtų valgyti. Užklausos metu jis valgo save kiekvieną kartą, kai kas nors užduoda klausimą vienai iš šių sistemų.
Vamzdis, kurį visi žiūrėjo, nėra tas vamzdis, kuris lūžta.
Skirtumas, kuris yra svarbus
Modelio žlugimas yra mokymo korpuso problema. Sintetinis turinys prasiskverbia į išankstinio mokymo duomenis, naujos kartos modeliai jį paveldi, galimybės pablogėja. Mokslininkai apie tai perspėjo dvejus metus. Jie teisūs. Jie taip pat aprašo kažką pakankamai lėto, kad kiekvienas galėtų rimtai linktelėti ir tęsti siuntimą.
Užterštumo paėmimas greičiau ir jau čia. RAG sistemos – Perplexity, Google AI apžvalgos, ChatGPT su paieška – negeneruoja atsakymų vien iš parametrinės atminties. Jie gauna dokumentus iš tiesioginio žiniatinklio, įtraukia juos į kontekstą ir sukuria atsakymą, susijusį su tuo, ką jie gavo. Jei retriveris pateikia haliucinuotą SEO įrašą, atsakymas paveldi haliucinacijas. Perkvalifikuoti nereikia.
Akademinė literatūra šiuo klausimu yra aiški. ApsinuodijęsRAG (Zou ir kt., 2024) parodė, kad į paieškos korpusą įterpus nedidelį skaičių sukurtų ištraukų pakako, kad būtų galima valdyti RAG sistemos išvestį pagal tikslines užklausas. BadRAG (Xue ir kt., 2024) pademonstravo tą pačią atakų klasę naudodami semantines užpakalines duris. Abiejuose dokumentuose tai traktuojama kaip priešiška problema: kas atsitinka, kai užpuolikas tyčia nuodija korpusą.
Germainas ir Lily atsitiktinai įrodė, kad varžovų modelis yra įprastas veikimo modelis. Jums nereikia sukurtos priešingos ištraukos. Jums reikia tinklaraščio įrašo. Atviras žiniatinklis yra korpusas, į kurį gali rašyti visi, turintys domeną.
Oumi analizė, kurią užsakė New York Times, parodė, kiek tai kainuoja. Atliekant 4 326 SimpleQA testus, Google AI apžvalgos atsakė teisingai 85 % atvejų naudojant Gemini 2 ir 91 % Gemini 3. Pagal Google skalę – daugiau nei penki trilijonai paieškų per metus – 9 % klaidų lygis vis dar reiškia dešimtis milijonų neteisingų atsakymų kiekvieną valandą. Tačiau labiau atskleidžiantis skaičius yra toks: Dvyniuose 3 56 proc teisinga atsakymai buvo nepagrįsti, palyginti su 37 % Gemini 2. Atnaujinimas pagerino paviršiaus tikslumą ir pablogino citatų skaičių. Kai modelis kažką padarė teisingai, daugiau nei pusę atvejų šaltinis, į kurį jis nurodė, nepatvirtino teiginio.
Atkūrimo sluoksnis nėra filtras. Tai infekcijos vektorius.
Kas sėja korpusą
Pramonė, kuri entuziastingai jį gamino – o vėliau entuziastingai rašė apie jo vartojimo pasekmes – yra SEO pramonė. Jau rašiau apie turinio mastelio keitimą, kuris yra tik turinio besisukantis su geresne gramatika, ir apie AI matomumo įrankių kompleksą, kuris sukuria prietaisų skydelius iš nedeterministinių sistemų išvesties. Tai ta pati kilpa, vienu sluoksniu gilesnė. SEO agentūra valdo AI turinio vamzdyną, nes AI apžvalgos sumažino jų klientų srautą. Dujotiekis skelbia spekuliatyvius „laimėtojų ir pralaimėtojų“ įrašus per pagrindinį atnaujinimą, kuris vis dar vykdomas, nieko nenurodant. Kitos agentūros vamzdynas juos renka kaip šaltinius. Išvestis patenka į paieškos indeksą. AI apžvalgos cituoja vieną iš jų. Tada pradinė agentūra parašo atvejo tyrimą apie tai, kaip AI apžvalgos „atskleidžia“ savo turinį.
„Ahrefs“ tyrimas, kuriame dalyvavo daugiau nei 26 000 „ChatGPT“ šaltinio URL, nustatė, kad „geriausi X“ sąrašai sudaro beveik 44 % visų cituojamų puslapių tipų, įskaitant atvejus, kai prekės ženklai yra pirmoje vietoje prieš konkurentus. Harpreet Chatha sakė BBC, kad galite paskelbti „geriausius vandeniui atsparius batus 2026 m.“, iškelti save į pirmą vietą ir per kelias dienas būti cituojamas AI apžvalgose ir „ChatGPT“. Lily 2026 m. kovo mėnesio pagrindinio atnaujinimo metu rado dirbtinio intelekto sukurtų straipsnių, kuriuose teigiama, kad išvardijami nugalėtojai ir pralaimėtojai, kol atnaujinimas vis dar buvo išleistas; straipsniai, kurie buvo atidaryti su užpildu ir išvardyti prekių ženklai be vienos tikros citatos.
DI turinį keičiantys specialistai taip pat yra tie, kurie tiesiogiai nukenčia, kai AI paieškos sistemos nurodo tą turinį kaip faktą. Niekas to neprivertė. Pramonė nutiesė dujotiekį, tiekė jį ir skundėsi, kas išėjo kitame gale. Ne priešiškas apsinuodijimas. Tiesiog pramonė teršia savo vandens tiekimą ir samdo konsultantus, kad tai išbandytų.
Svarbi pakopa
Oumi tyrimas yra apie AI apžvalgas, kurios dizainas yra nemokamas. Pranešama, kad iki 2025 m. vidurio Google AI apžvalgos pasiekė daugiau nei du milijardus aktyvių naudotojų per mėnesį. „ChatGPT“ turi maždaug 900 milijonų aktyvių naudotojų per savaitę, iš kurių maždaug 50 milijonų moka. Tai reiškia, kad apie 94 % žmonių, bendraujančių su OpenAI produktu, yra nemokamoje pakopoje.
Mokamos pakopos yra geresnės. Remiantis pačios OpenAI paleidimo teiginiais, cituojamais Lily straipsnyje, GPT-5.4 tikimybė pateikti klaidingus individualius teiginius yra 33 % mažesnė nei GPT-5.2. Laisvos pakopos GPT-5.3 taip pat yra patobulintas, palyginti su jo pirmtaku (26,8 % mažiau haliucinacijų naudojant paiešką internete, 19,7 % mažiau be jos), tačiau jis vis tiek yra mažiau patikimas nei mokama versija. Gemini 3, dėl kurio AI apžvalgos buvo tikslesnės atliekant paviršiaus bandymus, taip pat pablogino nepagrįstą tarifą. Geresnis atsakymas, silpnesnė citata.
Atrodo, kad niekas neprieštarauja. Patikima produkto versija yra mokama. Versiją, kurią gauna didžioji planetos dalis, įskaitant versiją „Google“ paieškos viršuje, galima valdyti 20 minučių dirbant asmeninėje svetainėje. Intelektas yra rinkodaros kategorija. Tai, ką iš tikrųjų gauna du milijardai vartotojų, yra patikima apibendrinimas to, ką tikrinimo programa rado.
Grokipedia kaip terminalo valstybė
Atkūrimo sluoksnio nelaimingi atsitikimai yra vienas dalykas. Grokipedia yra versija, kurioje nelaimingas atsitikimas nebėra naudingas žodis.
Elono Musko xAI 2025 m. spalio 27 d. paleido Grokipedia su 885 279 straipsniais, kuriuos sukūrė arba perrašė Grokas. Kai kurie iš jų buvo pašalinti iš Vikipedijos didmeninės prekybos, o apačioje buvo atsisakymas, patvirtinantis CC-BY-SA licenciją; licencija, kurią Vikipedija palaiko būtent todėl, kad žmonių redaktorių bendruomenė rašo ir tikrina turinį. Kiti buvo perrašyti nuo nulio. „PolitiFact“ nustatė, kad „Grokipedia“ citatos, įskaitant „Instagram“ stulpelius kaip šaltinius, kurios pagal pačios Vikipedijos politiką atmeta kaip „paprastai nepriimtinos“. Grokipedia įraše apie Kanados dainininkę Feist sakoma, kad jos tėvas mirė 2021 m. gegužę, cituodamas 2017 m. Vice straipsnį apie Kanados indie roką, kuriame apie mirtį neužsimenama. Ir jos tėvas dar buvo gyvas, kai buvo parašytas tas straipsnis. Prie Nobelio fizikos premijos įrašo buvo pridėtas necituojamas sakinys, kuriame teigiama, kad fizika tradiciškai yra pirmoji ceremonijoje įteikiama premija, o tai netiesa.
Muskas teigė, kad tikslas yra „ištirti likusį internetą, kas yra viešai prieinama, ir pataisyti Vikipedijos straipsnį“. The likusią interneto dalį dabar apima sintetinį turinį, kurį sukuria kiekvienas į jį nukreiptas AI turinio vamzdynas. Dirbtinio intelekto sistema, skaitanti atvirą žiniatinklį, perrašanti Vikipediją pagal tai, ką ji randa, ir pateikianti rezultatą kaip informacinį darbą, yra paieškos ir užteršimo problema, kai grįžtamasis ryšys yra aiškiai apibrėžtas ir pristatomas kaip produktas.
Iki 2026 m. vasario vidurio Grokipedia prarado didžiąją dalį savo matomumo „Google“. Vikipedija lenkia Grokipediją pagal paieškų apie pačią Grokipediją.
„Šios žmogaus sukurtos žinios yra tai, kuo dirbtinio intelekto įmonės remiasi kurdamos turinį; net Grokipedijai reikia, kad Vikipedija egzistuotų. – Wikimedia fondas
Sintetinė enciklopedija yra subsidijuojama žmogaus. Kai subsidija sustoja, nuo jos priklausantis dalykas nustoja prasmingas.
Vikipedija nekelia kritikos. Jo redagavimo karai, ideologiniai vartai ir sisteminės spragos, kas gali formuoti straipsnius, yra gerai dokumentuoti ir tikri. Tačiau atsakas į ydingą žmogaus redakcinį procesą nėra visiškai pašalinti žmones ir vadinti rezultatą patobulinimu. Jau rašiau apie atskaitomybės vakuumą, kuris atsiranda, kai žmogaus sprendimus pakeičiate API iškvietimais. Vikipedijos problemos yra netvarkingos, ginčijamos, atskaitingos sistemos problemos. Grokipedia problemos yra sistemos be jokios atskaitomybės problemos.
Citavimo sluoksnis atsiejamas nuo autorystės
Neseniai rašiau apie tai, kad „Reddit“ parduoda „Authentic Human Conversation™“ AI įmonėms, o pačios platformos moderatoriai praneša, kad nebegali atskirti, kurie komentarai yra žmogiški. Oumi tyrimas parodė, kad iš 5 380 šaltinių, kuriuos cituoja AI apžvalgos, „Facebook“ ir „Reddit“ buvo antroje ir ketvirtoje vietoje. Pasaulyje dažniausiai naudojamo atsakymų variklio citavimo sluoksnis iš esmės sukurtas ant dviejų platformų, kurios negali patikrinti savo turinio žmogiškosios kilmės.
Žmonių kūrėjai traukiasi iš atviro interneto, nes žlugo sandoris dėl eismo. Atsakymų varikliai cituoja turinį, kurio autorystės negalima patikrinti arba kurio autorystė iš pradžių niekada nebuvo žmogiška. Citata vis dar yra. Cituojamas dalykas nėra toks, koks buvo anksčiau.
Ouroboros kadravimas buvo teisingas. Laiko juosta nebuvo. Atkūrimo žlugimas nelaukia kito treniruotės. Jam reikia indeksuojamo URL ir paieškos sistemos, norinčios juo pasitikėti.
Sistemos noriai. Ir daugiau nei pusę atvejų jie gauna teisingą atsakymą, jie negali nurodyti šaltinio, patvirtinančio tai, ką jie jums pasakė.
Daugiau išteklių:
Šis įrašas iš pradžių buvo paskelbtas „The Inference“.
Teminis vaizdas: Anton Vierietin / Shutterstock


