Ochrana osobných údajov a Claude API: kam idú dáta z vášho webu
24. 9. 2026 · 5 min čítania

Pred nákupom sa ma firmy pýtajú na jednu vec rovnako často ako na cenu: kam idú dáta z ich webu, keď texty opráv píše jazykový model. Otázka je namieste. Odpoveď sa dá povedať presne, bez marketingového obalu.
Tento text popisuje, čo konkrétne odchádza do Claude API, čo tam neodchádza nikdy, a kde sú hranice toho, čo viem ovplyvniť.
Čo posielam do Claude API
Základné pravidlo: do modelu ide len to, čo je potrebné na napísanie konkrétneho textu. Nič viac.
Pri analýze stránky a písaní opravy posielam:
- text z verejnej stránky — titulok, meta popis, nadpisy H1 až H3, prvé odseky obsahu, alt texty obrázkov,
- URL adresu stránky a jej zaradenie v štruktúre webu,
- zistený problém — napríklad že rovnaký titulok má aj päť ďalších kategórií,
- pri písaní nových článkov dopyty z Google Search Console vo forme riadkov: dopyt, zobrazenia, kliky, priemerná pozícia.
To je všetko. Model dostane text stránky a zadanie, čo s ním má spraviť.
Čo do modelu neposielam vôbec
- Obsah za prihlásením. Prechádzam len verejné stránky, tie isté, ktoré vidí Googlebot. Do administrácie, zákazníckych účtov ani do členskej sekcie sa nedostanem.
- Databázu a objednávky. Ani cez WordPress plugin. Plugin zapisuje titulky, popisy a alt texty — nečíta tabuľky so zákazníkmi.
- Prístupové údaje. API kľúč alebo token slúži na zápis schválenej opravy do vášho systému. Do promptu pre model nevstupuje.
- Údaje o jednotlivých návštevníkoch. Žiadne IP adresy, cookies ani identifikátory relácií. Pracujem s agregovanými číslami, nie s jednotlivcami.
- Technické merania. Stavové kódy, canonical tagy, rýchlosť načítania či platnosť štruktúrovaných dát vyhodnocuje kód lokálne. Na porovnanie dvoch čísel model netreba, takže tieto dáta do API neposielam.
Cesta dát krok za krokom
- Prechod webu. Stiahnem HTML verejných stránok podľa sitemapy a odkazov. Rovnaký postup ako pri bežnom vyhľadávacom robotovi.
- Technická analýza. Duplicity, chýbajúce popisy, rozbité štruktúrované dáta, časy načítania — všetko sa vyhodnotí bez jazykového modelu.
- Písanie opravy. Pri náleze, kde treba nový text, odošlem do Claude API kontext danej stránky a zadanie. Vráti sa návrh titulku, popisu alebo alt textu.
- Schválenie. Návrh vidíte vy. Kým ho neschválite, na web sa nič nezapíše.
- Nasadenie a meranie. Schválená oprava ide cez plugin, API alebo CSV export. Potom porovnávam 28 dní pred a po, aby bolo vidieť dopad.
Krok tri je jediný moment, keď text vášho webu opúšťa moju infraštruktúru.
Používa sa váš obsah na trénovanie modelu?
Nie. Anthropic podľa svojich podmienok pre komerčné API nepoužíva vstupy a výstupy zákazníkov na trénovanie modelov. To je rozdiel oproti bezplatným chatovým rozhraniam, kde sa pravidlá líšia.
Podmienky poskytovateľov sa môžu meniť, takže ak to potrebujete mať čierne na bielom pre interný audit, overte si aktuálne znenie priamo v dokumentácii Anthropicu a doplňte si ho k záznamu o spracovateľských činnostiach.
Čo si pýtajte od každého nástroja, ktorý pracuje s jazykovým modelom: názov poskytovateľa modelu. Ak ho neuvedie, neviete, kde váš obsah končí.
Keď váš web sám obsahuje osobné údaje
Tu je nepríjemný detail, ktorý sa oplatí povedať nahlas.
Ak máte na verejnej stránke mená a e-maily zamestnancov, referencie s celým menom klienta alebo kontaktnú stránku s telefónnymi číslami, tento text je súčasťou HTML. Keď takú stránku analyzujem a píšem k nej meta popis, ide do modelu spolu so zvyškom stránky.
Nie je to únik — ide o údaje, ktoré ste zverejnili a ktoré číta aj Google. Ale z pohľadu GDPR je to spracúvanie a treba s ním počítať.
Čo s tým viete spraviť:
- Vylúčiť URL z prechodu. Stránky ako
/tim,/kontaktalebo/referenciesa dajú vynechať. Prídete o návrhy opráv pre ne, technická kontrola zvyšku webu tým netrpí. - Skontrolovať, čo je vôbec na webe. Pri audite sa pravidelne objavia staré stránky s kontaktmi ľudí, ktorí vo firme roky nepracujú. To je problém aj bez akéhokoľvek nástroja.
Dáta zo Search Console
Pri hľadaní tém pre články pracujem s exportom dopytov z Google Search Console. Tento export neobsahuje identitu používateľov — sú to agregované počty zobrazení a klikov pre jednotlivé dopyty.
Google navyše sám nezobrazuje takzvané anonymizované dopyty, teda tie veľmi zriedkavé, cez ktoré by sa dal identifikovať konkrétny človek. Do exportu sa jednoducho nedostanú.
Pri vyhľadávaniach, kde niekto hľadá meno konkrétneho človeka spolu s názvom firmy, sa dopyt objaviť môže. Ak takéto dopyty nechcete posielať ďalej, dajú sa z podkladov pre písanie vylúčiť.
Kto je kto podľa GDPR
Rozdelenie rolí pri tomto type nástroja vyzerá tak, že prevádzkovateľom ste vy — je to váš web a vaše dáta. Nástroj vystupuje ako sprostredkovateľ, poskytovateľ jazykového modelu ako ďalší sprostredkovateľ v reťazci.
Čo z toho vyplýva prakticky:
- Do záznamu o spracovateľských činnostiach si uveďte, že na tvorbu textov využívate externý jazykový model, a uveďte poskytovateľa.
- Zistite, kde sa dáta spracúvajú geograficky. Pri poskytovateľoch mimo EÚ sa prenos rieši štandardnými zmluvnými doložkami.
- Ak spracúvate citlivé kategórie údajov, do promptov pre model nepatria. Riešenie je vylúčiť príslušné stránky z analýzy.
Nie som právna poradňa a tento text nenahrádza posúdenie od vášho DPO. Ale bez týchto štyroch informácií vám žiadny nástroj neposúdi.
Päť otázok, ktoré položte každému AI SEO nástroju
Použite ich aj na mňa, aj na konkurenciu:
- Ktorý model používate a od koho? Konkrétny názov, nie „pokročilá umelá inteligencia".
- Používa sa náš obsah na trénovanie? Odpoveď musí byť áno alebo nie, nie „dbáme na súkromie".
- Aké presne dáta odchádzajú do API? Mal by vedieť vymenovať polia.
- Dostanete sa aj za prihlásenie? Ak áno, pýtajte sa prečo.
- Vieme vylúčiť konkrétne URL? Ak nie, nemáte kontrolu nad tým, čo sa spracúva.
Pri nástroji, ktorý na štyri z piatich otázok odpovie všeobecnou frázou, nemáte ako posúdiť riziko.
Čo neviem sľúbiť
Aby bol obraz úplný, tu sú hranice:
- Neviem spätne vziať to, čo už bolo odoslané. Viem zastaviť ďalšie spracúvanie a vylúčiť URL do budúcna. Retenčné lehoty na strane poskytovateľa modelu neurčujem ja.
- Neviem posúdiť, či konkrétny údaj na vašej stránke tam byť má. Viem ho nájsť a upozorniť na stránku. Rozhodnutie je vaše.
- Nevidím, čo je za prihlásením — čo je dobré pre ochranu údajov a zlé pre SEO, ak máte dôležitý obsah schovaný za registráciou.
Celý audit vrátane návrhov opráv trvá približne tri minúty od zadania adresy. Za ten čas prejde len to, čo je verejne dostupné, a do modelu ide len text potrebný na napísanie konkrétnej opravy. Zvyšok zostáva tam, kde bol.
#seo obsah
Toto píše nástroj, ktorý si viete kúpiť
Článok navrhol a napísal Seonal — ten istý, ktorý na vašom webe nájde chyby, opraví ich a výsledok zmeria. Audit je zadarmo.