
„Google“ paieškos advokatas Johnas Muelleris atmetė idėją sukurti atskirus „Markdown“ arba JSON puslapius tik dideliems kalbų modeliams (LLM), sakydamas, kad jis nesupranta, kodėl LLM reikia puslapių, kurių niekas kitas nemato.
Diskusija prasidėjo, kai Lily Ray „Bluesky“ paklausė apie „atskirų žymėjimo / JSON puslapių kūrimą LLM ir tų URL pateikimą robotams“ ir ar „Google“ galėtų pasidalinti savo požiūriu.
Ray paklausė:
Nežinote, ar galite atsakyti, bet pradedame daug girdėti apie atskirų žymėjimo / JSON puslapių kūrimą LLM ir tų URL teikimą robotams. Ar galite pasidalinti „Google“ požiūriu į tai?
Klausimas atkreipia dėmesį į besivystančią tendenciją, kai leidėjai kuria svarbių dalykų „šešėlines“ kopijas tokiais formatais, kuriuos dirbtinio intelekto sistemoms lengviau suprasti.
X vyksta aktyvesnė diskusija šia tema.
Pastaruoju metu tai buvo karšta tema, sulaukiu pasiūlymų iš įmonių, kurios tai daro https://t.co/rVnbPKUxZj
– Lily Ray 😏 (@lilyraynyc) 2025 m. lapkričio 23 d
Ką Muelleris pasakė apie tik LLM puslapius
Muelleris atsakė, kad iš „Google“ pusės nieko nežino, dėl ko reikėtų tokios sąrankos.
Jis pažymi, kad LLM nuo pat pradžių dirbo su įprastais tinklalapiais:
Aš nieko nežinau šiuo klausimu. Mano POV LLM nuo pat pradžių mokėsi – skaityti ir analizuoti – įprastus tinklalapius, atrodo, savaime suprantama, kad jiems nekyla problemų, susijusių su HTML. Kodėl jie norėtų matyti puslapį, kurio nemato joks vartotojas? Ir jei jie patikrina, ar nėra lygiavertiškumo, kodėl gi ne naudoti HTML?
Kai Ray'us išsiaiškino, ar atskiras formatas gali padėti „greitai gauti pagrindinius dalykus LLM“, Muelleris teigė, kad jei failų formatai reikšmingai pakeistų, greičiausiai tai išgirstumėte tiesiai iš tas sistemas valdančių įmonių.
Muelleris pridūrė:
Jei tie, kurie kuria ir naudoja šias sistemas, žinotų, kad gali sukurti geresnius atsakymus iš svetainių su tam tikrais failų formatais, tikiuosi, kad jie apie tai pasakytų labai daug. DI įmonės iš tikrųjų nėra žinomos kaip drovios.
Jis sakė, kad kai kurie puslapiai vis tiek gali veikti AI sistemoms geriau nei kiti, tačiau jis nemano, kad tai susiję su HTML ir Markdown:
Tai reiškia, kad galiu įsivaizduoti, kad kai kurie puslapiai geriau veiktų naudotojams, o kai kurie – geriau dirbtinio intelekto sistemoms, bet abejoju, kad taip yra dėl failo formato, ir tai tikrai nėra apibendrinta viskam. (Išskyrus JS, kuri vis dar atrodo sudėtinga daugeliui šių sistemų).
Apibendrinant, Muellerio komentarai rodo, kad, „Google“ požiūriu, jums nereikia kurti esamų puslapių tik „Markdown“ arba JSON klonų, kad juos suprastų LLM.
Kaip tinka struktūrizuoti duomenys
Kiti gijoje dalyvaujantys asmenys nubrėžė ribą tarp spekuliatyvių „šešėlinių“ formatų ir atvejų, kai AI platformos turi aiškiai apibrėžtus tiekimo reikalavimus.
Matt Wright atsakyme nurodė „OpenAI“ el. prekybos produktų sklaidos kanalus kaip pavyzdį, kai svarbios JSON schemos.
Šiame kontekste apibrėžtos specifikacijos nustato, kaip „ChatGPT“ gauna ir rodo produkto duomenis. Wright paaiškina:
Įdomu tai, kad „OpenAI eCommerce“ produktų sklaidos kanalai veikia: JSON schemos jau atlieka pagrindinį vaidmenį AI paieškoje.
Šis pavyzdys patvirtina idėją, kad struktūriniai sklaidos kanalai ir schemos yra svarbiausios, kai platforma paskelbia specifikaciją ir prašo ją naudoti.
Be to, Wright nurodo „LinkedIn“ giją, kurioje Chrisas Longas pastebėjo, kad „redakcinės svetainės, kuriose naudojamos produktų schemos, paprastai įtraukiamos į ChatGPT citatas“.
Kodėl tai svarbu
Jei abejojate, ar kurti „LLM optimizuotas“ „Markdown“ ar JSON versijas savo turiniui, šis pasikeitimas gali padėti jums grįžti prie pagrindų.
Muellerio komentarai patvirtina, kad LLM jau seniai gali skaityti ir analizuoti standartinį HTML.
Daugumoje svetainių produktyviau ir toliau gerinti greitį, skaitomumą ir turinio struktūrą puslapiuose, kuriuos jau turite, ir įdiegti schemą, kurioje yra aiškios platformos gairės.
Tuo pačiu metu „Bluesky“ gija rodo, kad AI būdingi formatai pradeda atsirasti siaurose srityse, pavyzdžiui, produktų sklaidos kanaluose. Juos verta stebėti, tačiau jie yra susieti su aiškia integracija, o ne su bendra taisykle, kad LLM yra geresnis sumažinimas.
Žvilgsnis į priekį
Pokalbyje pabrėžiama, kaip greitai dirbtinio intelekto pagrįsti paieškos pakeitimai virsta techniniais prašymais SEO ir kūrėjų komandoms, dažnai prieš tai, kai juos palaikoma dokumentacija.
Kol LLM teikėjai nepaskelbs konkretesnių gairių, ši gija nukreips jus į darbą, kurį šiandien galite pateisinti: laikykite HTML švarų, sumažinkite nereikalingą „JavaScript“, kur sunku analizuoti turinį, ir naudokite struktūrinius duomenis, kai platformos turi aiškiai dokumentuotas schemas.
Teminis vaizdas: Roman Samborskyi / Shutterstock



