Preskočiť na obsah
2.9Expert10 min

Štruktúrované dáta ako vrstva porozumenia AI

Lucas Blochberger··Updated 11. júna 2026
Definition

Štruktúrované dáta sa vyvinuli z nástroja pre rich results na vrstvu porozumenia AI. Google, Microsoft a ChatGPT potvrdzujú využitie pre generatívne funkcie.

Key Takeaways

  • Google potvrdil štruktúrované údaje pre AI-Features (marec/máj 2025)
  • Microsoft potvrdil používanie schémy pre Copilot na SMX Mníchov
  • ChatGPT Shopping (50M denných nákupných dopytov) uprednostňuje Product Schema
  • NLWeb robí webové stránky anotované schémou na MCP-servery pre AI-agentov
  • Experiment Search Engine Land: Iba stránka so schémou sa objavila v AI Overview
  • Google zastavil 7 typov schém od júna 2025
  • Protipunkt: Žiadne recenzované študie o vplyve schémy na AI

Štruktúrované dáta prekročili kontext bohatých výsledkov a stali sa primárnou čitateľnou vrstvou pre stroje, prostredníctvom ktorej AI-systémy analyzujú význam webov.

Trojitá potvrdzovacia správa

Na SMX München v marci 2025 vysvetlil Fabriceov Bingu Canel: „Schema Markup helps Microsofts LLMs understand content." Google potvrdil v apríli/máji 2025, že štruktúrované dáta prinášajú výhody pre AI-funkcie vyhľadávania. ChatGPT Shopping (spustené 24. novembra 2025, 50 miliónov denných otázok o nákupoch) dáva prednosť serverom renderovanému Product-Schema v JSON-LD.

NLWeb: Schema ako AI-infraštruktúra

Microsoft NLWeb bol oznámený 19. mája 2025 spoločnosťou R.V. Guha — vynálezcom RSS, RDF a Schema.org, teraz Microsoft CVP a Technical Fellow. NLWeb prechádza webové stránky, extrahuje Schema.org JSON-LD a konvertuje ho na dáta vzťahujúce sa na otázky. Každá NLWeb-inštancia sa automaticky stáva MCP-serverom, ktorý robí obsah webov dostupným pre AI-agentov prostredníctvom ekosystému MCP.

Ukončené schémové typy

Google od júna 2025 ukončil sedem typov štruktúrovaných dát. FAQ Rich Results boli obmedzené na webové stránky orgánov a zdravotníckych služieb (august 2023). HowTo bol úplne ukončený v septembri 2023. Dôležité: Ukončenie sa týka zobrazenia bohatých výsledkov, nie sémantického použitia AI-systémami.

Protinázor

Štúdia z decembra 2024 (Search/Atlas) nenašla koreláciu medzi pokrytím schémou a sadzbami AI-citovania. Neexistujú žiadne orecenzované štúdie o vplyve Schema-AI. Schema funguje ako akcelerátor porozumenia AI v kombinácii s kvalitným obsahom, nie ako signál bez podpory.

Údaje a štatistiky

JSON-LD war 2024 auf 41 Prozent der Seiten vorhanden (gegenueber 34 Prozent 2022) und ist das am schnellsten wachsende der drei Formate (JSON-LD, RDFa, Microdata)

Web Almanac 2024 (HTTP Archive), Kapitel Structured Data (2024)

JSON-LD-Typverteilung (mobil, 2024): WebSite 12,73 Prozent, Organization 7,16 Prozent, BreadcrumbList 5,66 Prozent, LocalBusiness 3,97 Prozent, Product nur 0,77 Prozent

Web Almanac 2024 (HTTP Archive), Kapitel Structured Data (JSON-LD section, mobile pages) (2024)

Fabrice Canel (Microsoft Bing) bestaetigte auf der SMX Muenchen im Maerz 2025, dass Schema-Markup den LLMs von Microsoft (Copilot) hilft, Inhalte zu verstehen

Search Engine Land (Barry Schwartz), zitiert Fabrice Canel, Principal Product Manager, Microsoft Bing, SMX Muenchen (2025)

Das Google-Search-Team erklaerte im April 2025, dass strukturierte Daten einen Vorteil in den Suchergebnissen verschaffen

Search Engine Land, Schema markup and AI search (with no hype) (2025)

Jede NLWeb-Instanz ist zugleich ein Model-Context-Protocol-Server (MCP); NLWeb baut auf vorhandenen Schema.org- und RSS-Daten plus LLMs auf und wurde von R.V. Guha (Schoepfer von RSS, RDF, Schema.org) entwickelt; vorgestellt am 19. Mai 2025

Microsoft Source, Introducing NLWeb: Bringing conversational interfaces directly to the web (2025)

Generative Engine Optimization (GEO) kann die Sichtbarkeit in generativen Antworten um bis zu 40 Prozent steigern; Quellen, Zitate und Statistiken erhoehen die Sichtbarkeit um ueber 40 Prozent; auf Perplexity.ai bis zu 37 Prozent; Benchmark aus 10.000 Anfragen und 9 Methoden

GEO: Generative Engine Optimization, Aggarwal et al. (Princeton et al.), KDD 24, arXiv:2311.09735v3 (2024)

Crawl-to-refer-Verhaeltnis (Juli 2025): Anthropic 38.065,7 zu 1, OpenAI 1.091,4 zu 1, Google 5,4 zu 1; rund 80 Prozent des KI-Crawlings dienen dem Training (18 Prozent Suche, 2 Prozent Nutzeraktionen)

Cloudflare Blog, From crawl to click: the bots, the gap, and the road ahead (2025)

In Deutschland nutzen 67 Prozent der Menschen ab 16 Jahren zumindest gelegentlich generative KI (2025, gegenueber 40 Prozent im Sommer 2024); ChatGPT 43 Prozent, Copilot 39 Prozent, Gemini 28 Prozent

Bitkom, repraesentative Befragung (Daten fuer Deutschland) (2025)

ChatGPT erreichte 800 Millionen woechentlich aktive Nutzer (Ankuendigung 6. Oktober 2025)

TechCrunch (Sam Altman / OpenAI, Dev Day Keynote) (2025)

8,69 Millionen Internetnutzer in Oesterreich bei 95,3 Prozent Penetration (Januar 2025)

DataReportal, Digital 2025: Austria (2025)

Často kladené otázky

Čo sú štruktúrované dáta a prečo sú dôležité pre AI?
Štruktúrované dáta sú strojovo čitateľné označenia, väčšinou podľa slovníka Schema.org vo formáte JSON-LD, ktoré strojom oznamujú význam obsahu. Namiesto toho, aby sa telefónne číslo zobrazovalo len ako text, markup explicitne hovorí, že ide o telefónne číslo alebo cenu produktu. Pre AI sú dôležité, pretože generatívne systémy využívajú túto vrstvu významu na spoľahlivejšie extrahovanie entít a faktov. Microsoft oficiálne potvrdil, že Schema markup pomáha jeho LLM rozumieť obsahu.
Využíva ChatGPT štruktúrované dáta?
Priamo to nie je potvrdené. Pre ChatGPT neexistuje porovnateľne jasné oficiálne vyhlásenie ako pri Microsofte, že Schema markup sa spracováva ako samostatný signál. ChatGPT Search však stavia na Bing indexe a Microsoft potvrdil, že Schema pomáha jeho LLM. Kto optimalizuje obsah pre Bing index, nepriamo adresuje aj ChatGPT Search. Samostatný, kauzálny Schema efekt na ChatGPT však nie je podložený recenzovanými štúdiami.
Aký formát by som mal použiť pre štruktúrované dáta, JSON-LD alebo Microdata?
JSON-LD. Je to formát odporúčaný Googlom a fakticky dominantný. Podľa Web Almanac 2024 bol JSON-LD prítomný na 41 percentách stránok oproti 34 percentám v roku 2022 a je najrýchlejšie rastúcim z troch formátov. JSON-LD stojí zoskupený v jednom script bloku, oddelený od viditeľného HTML, čo uľahčuje údržbu a validáciu. Microdata a RDFa prepletajú markup do HTML tagov a sú náchylnejšie na chyby.
Čo je NLWeb a co to znamená pre moju webovú stránku?
NLWeb je projekt predstavený Microsoftom v máji 2025, ktorý kombinuje existujúci markup ako Schema.org a RSS s jazykovými modelmi do prirodzeno-jazykového rozhrania. Rozhodujúce: Každá NLWeb inštancia je zároveň Model-Context-Protocol server (MCP), čím môžu webové stránky sprístupniť svoj obsah pre AI agentov. Pre vašu webovú stránku to znamená, že čistý, kompletný Schema markup už nemoduluje len pre vyhľadávače, ale zároveň vytvára základ pre agentické dotazy.
Oplatí sa ešte FAQ Schema, hoci Google obmedzil FAQ Rich Results?
Záleží na cieli. Google zobrazuje FAQ Rich Results už len pre niekoľko autoritatívnych zdrojov, takže garantované vizuálne zobrazenie v klasickom vyhľadávaní vo veľkej miere odpadlo. Základný markup však zostáva jasným extrakčným signálom pre obsah, ktorý priamo odpovedá na otázku. Schema typy by sa preto mali vyberať podľa ich hodnoty pre strojové porozumenie, nie len podľa aktuálneho Rich Result zobrazenia, ktoré môže Google kedykoľvek zmeniť.
Ako zmeriam, či moje štruktúrované dáta fungujú?
Na troch úrovniach. Po prvé technická validácia pomocou Rich Results Testu, ktorý overuje, či je markup správny a obsahuje všetky povinné polia. Po druhé Google Search Console, ktorá ukazuje, ktoré typy boli rozpoznané, či existujú chyby a ako sa vyvíjajú impressions a kliky. Po tretie AI Citation Tracking, teda sledovanie zmienok v systémoch ako ChatGPT alebo Perplexity. Tretia úroveň je ešte mladá a čistý kauzálny vzťah k markupu je ťažké stanoviť.
Sú štruktúrované dáta problém z hľadiska GDPR?
Spravidla nie. Štruktúrované dáta sú nekritické, pokiaľ len sprístupňujú strojovo čitateľné verejné, vecné informácie, ako názov firmy, adresu alebo produktové údaje. JSON-LD nenastavuje cookies a nie je tracking, preto nepatrí za consent bariéru. Opatrnosť je potrebná len pri osobných údajoch, napríklad keď sa fyzická osoba označuje menom, fotografiou alebo kontaktnými údajmi. Potom platia bežné požiadavky GDPR na právny základ a účelovosť.

Related Articles

Ako si stojí vaša stránka?

Získajte bezplatný SEO report vašej stránky e-mailom – technické SEO, on-page, kľúčové slová a konkurencia. Nezáväzne.

Vyžiadať bezplatný SEO audit