Multimodální obsah
Proč multimodální obsah rozhoduje v éře ChatGPT
Optimalizace pro generativní modely (SEO pro ChatGPT) vyžaduje, aby vaše vizuály a multimédia byly nejen estetické, ale i strojově uchopitelné. LLM a multimodální modely potřebují kvalitní textové ukotvení: přesné popisy obrázků, strukturované transkripty videí a grafy s jasně čitelnou legendou. Cílem je umožnit modelům bezpečně extrahovat fakta, vztahy a interpretace bez halucinací a zároveň zlepšit přístupnost pro lidi.
Zásady GEO pro multimodální aktiva
- Jednoznačnost: každé médium musí mít jasný účel, název a textový popis vázaný na URL/fragment.
- Redundance s mírou: krátký popis (alt) + dlouhý popis (dlouhá legenda/longdesc) + strojová metadata.
- Mapování na data: pokud vizualizace vznikla z datasetu, zpřístupněte
.csv/.jsona uveďte verzi. - Verifikovatelnost: popis obsahuje zdroj, datum sběru a metodiku (pokud je relevantní).
- Kompozice pro retrieval: sekcionování, id kotvy (
id=), titulky a prolinkování na související pojmy.
Popisy obrázků: alt, dlouhé popisy a kontext
Popis obrázku plní tři úkoly: přístupnost, indexaci a grounding pro multimodální modely. Nestačí jednovětý alt; důležitý je také dlouhý popis a kontext v textu stránky.
Struktura popisu
- Alt text (krátký): 80–150 znaků, informuje o tom, co je na obrázku a proč je důležitý v dané sekci.
- Dlouhý popis: odstavec až dva, shrnuje klíčové prvky, kvantitativní údaje a význam pro čtenáře.
- Legenda/Caption: stručná citace zdroje, rok, metodický kontext.
- Metadata: autor, licence, klíčové entity (osoby/místa/produkty) v microdata nebo JSON-LD.
Příklady správných alt textů
| Scéna | Nesprávný alt | Správný alt |
|---|---|---|
| Sloupcový graf tržeb | graf |
Sloupcový graf: čtvrtletní tržby 2023–Q2 2025, růst z 1,2 na 2,1 mil. €; nejvyšší Q1 2025 |
| Produktová fotografie | telefon |
Smartfon X12, 6,7″ OLED, foto modul 50 MP, barva grafit, zobrazený profil rámu |
| Mapa hustoty | heatmapa |
Mapa hustoty návštěvnosti: nejvyšší koncentrace v centru Bratislavy, pokles směrem na sever |
Kontextové ukotvení
Obrázek umístěte přímo za odstavec, který jej vysvětluje. V textu používejte odkazy na kotvy (např. „viz Graf penetrace“), čímž zvýšíte pravděpodobnost, že retriever vybere správný blok i bez obrázku.
Transkripty videí: přesnost, časové značky, kapitoly
LLM preferují text. Proto ke každému videu publikujte úplný přepis a pokud možno i kapitoly s názvy a časovými značkami. To výrazně zvyšuje šanci na citovatelnost a extrakci faktů.
Požadavky na transkript
- Přesnost ≥ 95 %: ruční korekce ASR; označte speciální termíny a vlastní jména.
- Časové značky: každých 20–60 sekund nebo po logickém bloku, formát
[mm:ss]. - Účastníci: označení mluvčích (
Moderátor:,Host:), stručné bio při první zmínce. - Vizuální prvky: verbálně popište klíčové snímky („[03:12] zobrazený lineární graf s výrazným zlomem v Q4 2024“).
- Jazykové varianty: pokud je video vícejazyčné, publikujte paralelní přepisy a propojte je rel-linky.
Kapitoly a propojení
Každá kapitola má vlastní kotvu id=, krátký název a odkaz na související sekce článku nebo datasety. Modely tak najdou přesnou pasáž bez přehrávání videa a získají citelný snippet do odpovědí.
Grafy s legendou: čitelnost pro lidi i stroje
Grafy bez legendy nebo s legendou zakódovanou pouze barvou jsou pro stroje „neviditelné“. Přidejte textovou legendu, deklarujte jednotky a popište metodiku agregace. Preferujte SVG s přístupností (title/desc), aby bylo možné extrahovat i bez OCR.
Prvky kvalitního grafu
- Název a podnázev: co, kdy, v jakých jednotkách (
%,€,index=100). - Legenda: pojmenované série, styl a význam zvýraznění (např. „tučná čára = klouzavý průměr 3M“).
- Osy: jasné označení, intervaly, nulový bod.
- Popisky extrémů: max/min, zlomové body, anotace s datem a hodnotou.
- Zdroj a metoda: „sezónně očištěné, HICP, zdroj: …, verze datasetu v1.3“.
Konverze grafu na text
Po grafu vždy uveďte 2–3 věty verbální interpretace a shrnutí klíčových čísel, aby retrievery měly „tlumočníka“ vizuálu.
Schémata, metadata a propojení (Schema.org, IPTC, ARIA)
- Schema.org: použijte
ImageObject,VideoObject,DatasetaCreativeWorkv JSON-LD. Zahrňtecaption,description,encodingFormat,contentUrl,thumbnailUrl,uploadDate,license,isBasedOn(odkaz na data). - IPTC/EXIF: vkládání autora, copyrightu, klíčových slov a popisů přímo do souborů pomáhá zachovat metadata při sdílení.
- ARIA: pro skupiny grafů používejte landmarky a
aria-labelledby/aria-describedbypro čitelnost čtečkami a modely.
Publikování: HTML vzory, feedy a kanonické prvky
Obrázek s krátkým a dlouhým popisem
<figure id="obr-penetracia"><img src="penetracia.svg" alt="Penetrace služby 2022–2025: růst z 12 % na 28 %, prudký skok v Q1 2025"><figcaption>Penetrace služby podle kvartálů; zdroj: Panel N=2 100, metodika: vážení podle věku a regionu.</figcaption></figure>
Video s přepisem a kapitolami
<section id="video-case"><h3>Demonstrace produktu</h3><video controls src="demo.mp4" poster="demo.jpg"></video><ol><li id="kap-1">[00:00–01:10] Úvod a problém</li><li id="kap-2">[01:10–03:45] Řešení a architektura</li></ol><article id="transkript"><p>[00:12] Moderátor: Představujeme…</p><p>[01:25] Demo: Zobrazený graf…</p></article></section>
Graf se zpřístupněnými daty
<figure id="graf-penetracia"><svg role="img"><title>Penetrace služby 2022–2025</title><desc>Čára ukazuje růst z 12 % na 28 %, skok v Q1 2025</desc>…</svg><figcaption>Série A: Celková populace; Série B: 18–34. Jednotky: %. Zdroj: průzkum, v1.3. <a href="data/penetracia.csv">CSV</a> · <a href="data/penetracia.json">JSON</a></figcaption></figure>
Feedy a indexy
- Sitemap pro multimédia: zahrňte položky s
<image:image>/<video:video>, daty a tituly. - Atom/RSS: publikujte novinky o nových videích, grafech a datasetech v jediném kanonickém feedu.
RAG a retrievery: jak strukturovat multimodální korpus
- Chunkování: udržujte bloky 500–1 200 tokenů; pro grafy samostatný chunk s legendou a odkazem na data.
- Ukotvení entit: používejte konzistentní názvy entit (ISO kódy, SKU, osoby) a interní odkazy.
- Propojení na tvrzení: každé vizualizaci přiřaďte alespoň jedno evidovatelné tvrzení (ID, zdroj, datum, verze).
- Vektorizace: ukládejte popisy obrázků, kapitoly videa a legendy grafů do vektorového indexu, nikoli samotná binární média.
Metriky a experimenty
| Metrika | Definice | Cíl/Interpretace |
|---|---|---|
| Caption Recall@K | Podíl dotazů, při kterých se správný obrazový popis objeví v Top-K pasážích. | > 0,8 při K=5 po zavedení dlouhých popisů. |
| Transcript Coverage | % videí s úplným, časově označeným přepisem. | Cíl 100 % u TOP obsahových URL. |
| Chart Interpretability Score | Heuristika: přítomnost legendy, jednotek, popisu extrémů, zdroje, datového odkazu. | > 4/5 pro všechny grafy v kanonických článcích. |
| Data-Link Utilization | Kolikrát byla stažena CSV/JSON připojená ke grafu. | Růst o 20–30 % po zveřejnění. |
| LLM Citation Rate | Podíl odpovědí, kde jsou citovány vaše multimodální bloky. | Korelace s kvalitou popisů a legendy. |
Governance: workflow, kvalita a aktualizace
- Standardy: styleguide pro alt texty, šablony přepisů, minima pro legendy grafů.
- Kontroly: před publikováním běžná kontrola: přítomnost alt, figcaption, zdroje, jednotky, odkazy na data.
- Verzování: při aktualizaci grafu zvyšujte verzi dat i vizuálu a uveďte changelog.
- Licence a práva: jasně komunikujte licencování (CC BY, ODbL, vlastní práva na video/audio).
Implementační checklist
- Každý obrázek: krátký alt + dlouhý popis + figcaption se zdrojem a rokem.
- Každé video: úplný přepis s časovými značkami + kapitoly s kotvami + popis vizuálních prvků.
- Každý graf: název, jednotky, legenda, anotované extrémy, odkaz na CSV/JSON, verze datasetu.
- Vše označeno v JSON-LD:
ImageObject,VideoObject,Dataset


























