Praha 1 zavřela web umělé inteligenci a tím i občanům cestu k analýzám

Začátkem srpna jsem zjistil, že můj ChatGPT agent pro Prahu 1 přestal pracovat s informacemi z webů Prahy 1, jako jsou https://www.praha1.cz/ nebo https://transparentni.praha1.cz/. Přitom eviduji do dnešního dne stovky použití. Začal jsem pátrat, proč tomu tak je, a velmi rychle jsem přišel na to, že někdo nastavil web tak, aby odmítal poskytovat informace různým AI. Toho lze jednoduše dosáhnout úpravou souboru robots.txt.

Tady jsou nové instrukce zakazující přístup různým AI:

robots.txt 2025-08-12

Napsal jsem tedy ve čtvrtek 6. 8. 2025 panu Richardu Burešovi, radnímu pro informatiku, že někdo asi omylem aktivoval zákaz AI, takže teď není možné vyhledávat a hlavně analyzovat informace uvedené na webu. Pan Bureš mi obratem odpověděl, že minulý týden byly spuštěny firewally magistrátu, což by mohlo být příčinou.

V úterý 12. 8. 2025 jsem mu napsal znovu, jestli neví něco nového. V odpovědi jsem se dozvěděl, že:

Nastavení bylo provedeno na základě doporučení MHMP a NÚKIB cíleně.

Důvod nastavení zákazu přístupu AI botům z pohledu kybernetické bezpečnosti

Omezení přístupu vybraným robotům (např. ChatGPT-User, GPTBot, ClaudeBot, Google-Extended, PerplexityBot aj.) prostřednictvím souboru robots.txt je opatřením ke snížení rizik spojených s automatizovaným sběrem dat (tzv. scraping) a jejich následným využitím třetími stranami.

Dále jsem dostal tyto důvody:

Z hlediska kybernetické bezpečnosti má tento zákaz tyto opodstatněné důvody:

  1. Omezení hromadného stahování a archivace obsahu
    • Velké jazykové modely a vyhledávací AI systémy mohou v krátkém čase stáhnout velké množství dat včetně neveřejně citlivých informací (např. z kontextu odvozené osobní údaje).
    • Hromadné stahování může vést k nepovolenému dlouhodobému uchování a dalšímu šíření dat, nad nimiž organizace ztratí kontrolu.
  2. Minimalizace rizika zneužití informací
    • Obsah může být zkombinován s jinými zdroji a použit k cíleným dezinformačním kampaním, phishingu nebo jiným formám sociálního inženýrství.
    • Přístup AI botů umožňuje útočníkům snadno analyzovat interní strukturu webu a hledat slabá místa.
  3. Ochrana před neautorizovaným profilováním
    • AI modely mohou data využít k profilování konkrétních osob, organizací nebo procesů, což může vést k porušení legislativy (např. GDPR).
    • V případě úředních či samosprávných webů může dojít k nežádoucímu zpřístupnění informací v souvislostech, které původně nebyly zamýšleny.
  4. Snížení zátěže na infrastrukturu
    • Někteří roboti neomezují rychlost stahování, což může zatěžovat webové servery a ovlivnit dostupnost pro legitimní uživatele.
    • Zátěž může vést až k výpadkům, které představují incident dostupnosti dle nZoKB.
    • Prevence nekontrolovaného šíření zastaralých nebo chybně interpretovaných dat
    • AI systémy nemají povinnost průběžně aktualizovat databázi staženého obsahu, a mohou tak dlouhodobě šířit neaktuální nebo neúplné informace. To může mít negativní dopad na důvěryhodnost instituce.

Tento dokument se mi nepodařilo nikde dohledat ani na MHMP, ani na NÚKIB. Zajímal mě totiž kontext. Zajímavé je, že na webu MHMP, který to údajně doporučil, žádné takové omezení není a ani jsem ho nenašel na jiných stránkách městských částí. Tady byl asi někdo v MČ Praha 1 velmi aktivní.

Navíc celé zdůvodnění je značně zavádějící a středoškolský student informatiky by většinu těchto argumentů rozmetal na prach bez přípravy.

Omezení hromadného stahování?
Jako že Google a jiné vyhledávače hromadně nestahují? A obava, že když si někdo stáhne veřejně přístupný dokument, organizace nad ním ztratí kontrolu? Jakmile něco vložím na internet, o tu kontrolu jsem přišel. Tak proč to řeší u AI?

Minimalizace rizika zneužití informací?
Jako že veřejně přístupné dokumenty by se neměly analyzovat, aby z nich někdo něco nezjistil? To snad ne.

Ochrana před neautorizovaným profilováním?
Jako že MČ umístí na web dokumenty, z nichž lze vyčíst, že někdo ze zastupitelů podezřele často kolem osmnácté hodiny odchází ze zastupitelstva a vrací se v osmnáct třicet?

Snížení zátěže na infrastrukturu
Jako že máme tak špatně vyřešenou kapacitu serverů a linek a neumíme nastavit firewally, že občasné zabrouzdání od AI shodí web? A existují k tomu nějaká data, že k tomu došlo, když AI mohla na webu dříve normálně pracovat? Asi ne.

Navíc způsob omezení, který zvolili, bude respektovat jen ta „hodná“ AI. Pro návštěvníka webu je to totiž jen doporučení typu *prosím, jestli jsi AI, tak sem nechoď. Děkuji!*. Myslíte si, že „jiné“ AI, které se používají pro podvody a dezinformace, to budou respektovat?

Co mě ale úplně dostalo, bylo tvrzení, že AI nebývá spolehlivá, takže jejím zákazem nás vlastně chrání před chybnými interpretacemi. To by bylo vhodné, aby nám ke všem poskytnutým informacím rovnou dali i výklad, jak je máme chápat. Abychom nemuseli přemýšlet a dělat si své závěry, nebo abychom si nevytvořili vlastní názor, který nemusí být v souladu s názorem vedení. Opravdu je rok 2025?

Pro jistotu jsem se zeptal samotné AI, jestli tento způsob blokování dává smysl, a tohle je výsledek. V zásadě píše to samé co já, akorát velmi korektně.

Pokud se politici Prahy 1 obávají výše uvedeného, jediný správný postup je zrušit web Prahy 1. Není možné, aby Praha 1 poskytovala informace, které si občané mohou špatně vykládat. Nebo informace, ze kterých lze dovodit, že někdo něco neudělal správně či v rozporu s veřejnými prohlášeními.

Pan Bureš dále psal, že „Příští týden je pak jednání informatiků na téma bezpečnosti a souvisejících nastavení na HMP. Je možné, že z něj vyplynou nějaké změny.“ A že mě bude dále informovat.

Odepsal jsem mu, že důvody zákazu přístupu AI na web Prahy 1 mi přijdou absurdní a proč. Také jsem se ho zeptal, kdo konkrétně tohle nařídil. To mě velmi zajímá. Obávám se totiž, že výše uvedené zdůvodnění jsou jen zástupné problémy a hlavní důvod je zamezení analýzy dat pokročilými technologiemi.

Jakmile se dozvím něco dalšího, budu vás informovat.

Obávám se, že tohle může být záměr, jak občanům zamezit analyzovat veřejná data jednoduchým způsobem. Že současná radnice není nakloněná informovanosti, si můžeme připomenout v článku Chtějí nás zastupitelé Prahy 1 informovat o důležitých věcech, na kterých pracují? Zeptal jsem se jich..

Je docela možné, že bude trvat dlouho, možná až do voleb, než bude web Prahy 1 možné analyzovat běžnými AI metodami.

Proto bude třeba stáhnout veřejné dokumenty, jako jsou zápisy ze zasedání, komisí a rad, a vložit je na jiný web, který nemá omezení pro AI, dokud se tato nešťastná situace nevyřeší.

Jestli mi s tím chcete někdo pomoci, pište prosím na michal@termiter.cz. Děkuji!

  • Napsal jsem panu Burešovi, jak dopadlo to jednání informatiků, které mělo být minulý týden. — Michal Rubeš 2025/08/25 13:39
  • První veřejná reakce od zástupce koalice. Radní Ryvola se v úterý 2. 9. 2025 zeptá na radě. — Michal Rubeš 2025/08/31 09:56
  • Po dalším týdnu žádná reakce od pana Bureše. Napsal jsem mu a připomněl jsem se. — Michal Rubeš 2025/09/01 09:05
  • Další týden bez reakce od pana radního Bureše. Pan radní Ryvola se neozval, zda se zeptal na radě. Komunikaci s panem Burešem posílám na paní starostku s žádostí o vysvětlení. E-mail paní starostce z 8. 9. 2025. — Michal Rubeš 2025/09/08 15:23
  • Urgoval jsem pana Ryvolu, jestli se na té radě zeptal. — Michal Rubeš 2025/09/09 14:02
  • Urgoval jsem email na paní starostku, která neodpověděla. — Michal Rubeš 2025/09/15 15:17
  • Další urgence e-mailem paní starostce a panu Burešovi. — Michal Rubeš 2025/09/22 15:26
  • Poslední urgence paní starostce a panu radnímu. Je jasné, že se odmítají k této věci vyjádřit. — Michal Rubeš 2025/10/06 21:18

Včera, tedy v pondělí 13. 10. 2025, jsem vložil na Facebook shrnující příspěvek, ve kterém jsem popsal mojí snahu o objasnění této cenzury. Je zřejmé, že se jedná o záměr namířený proti informovanosti občanům. Vzhledem k tomu, že koaliční zastupitelé odmítají tuto cenzuru řešit, dokonce i odmítají v této věci jakkoliv komunikovat, je třeba kauzu dostatečně připomenout před volbami. Nemyslím si, že občané chtějí zastupitele, kteří jim záměrně blokují přístup k informacím a ještě odmítají na toto téma diskutovat.

Měl jsem za to, že tím záležitost končí, ale příspěvek na Facebooku, který vzbudil pro radnici nežádoucí pozornost, zřejmě způsobil, že mi paní starostka ve středu 15. 10. 2025 odpověděla.

Shrnutí dopisu starostky:
Starostka mě ujistila, že se úřad Prahy 1 problematikou přístupu umělé inteligence na web zabývá. Opatření, která omezují činnost AI nástrojů, byla podle ní přijata na základě doporučení konzultanta a „manažera kybernetické bezpečnosti“ s cílem chránit infrastrukturu, zabránit šíření zastaralých informací, předejít zneužití dat a snížit riziko cílených útoků. Úřad si také vyžádal stanovisko NÚKIB a plánuje technické úpravy nového webu, které s aktivitou AI crawlerů počítají.

Ve čtvrtek 16. 10. 2025 jsem paní starostce odpověděl a zde je stručné shrnutí:
Ve své reakci upozorňuji, že úřad dosud nezveřejnil žádné oficiální vysvětlení, a ptám se, kdo o blokaci rozhodl, na základě čeho a proč. Požaduji zveřejnění doporučení, která k opatření vedla, i vyjádření NÚKIB a Magistrátu. Zpochybňuji jak technické, tak politické argumenty – infrastruktura se podle dostupných informací nepřetížila, a i kdyby ano, podobný problém žádný jiný úřad nehlásí. Blokace je navíc fakticky neúčinná, protože ji řada nástrojů obchází. Politické důvody pak nedávají smysl a naznačují spíše snahu omezit přístup k informacím. Zásadní otázkou zůstává, kdo konkrétně dal pokyn k blokaci a proč nebyl o kroku informován nikdo z vedení radnice.

  • Urgence s tím, ať se paní starostka soustředí na otázku Proč Praha 1 jako jediná veřejná instituce v České republice přistoupila k cenzuře přístupu k webu? — Michal Rubeš 2025/11/03
  • Další urgence s informací, že Praha 1 spustila vlastní AI a všechny zmiňované důvody pro blokaci padly. — Michal Rubeš 2025/11/10 14:00

V neděli večer jsem se díval na web Prahy 1 a robots.txt byl čistý, jak ho má drtivá většina všech webů. Říkal jsem si, že cenzoři konečně ustoupili. Jaké však bylo moje překvapení dnes v pondělí dopoledne, když jsem zjistil, že sice většina webu je nyní přístupná pro AI, ale naopak informace o zastupitelích, radě a zaměstnancích již nejsou přístupné žádným vyhledávačům jako Google nebo Seznam. Napsal jsem panu radnímu za IT panu Burešovi, zda to není nějaká chyba. — Michal Rubeš 2025/12/01 11:39

Tady jsou nové instrukce zakazující přístup vyhledávačům:

robots.txt 2025-12-01

Záhy si však uvědomili, že zakazovat přístup vyhledávačům ke kontaktům politické reprezentace je nesmysl a tuto část odstranili. Zůstal tedy zákaz přístupu ke kontaktům na úředníky. To je samozřejmě také nesmysl. Pokud nechtějí, aby tyto kontakty nebyly na internetu, tak ať je tam nedávají. Málokdo potřebuje jméno konkrétního úředníka a telefon na něj. Občanovi stačí obecný kontakt na oddělení.

robots.txt 2025-12-20

V pondělí odpoledne (13. 4. 2026) jsem dělal nějaké analýzy a ChatGPT mi napsal, že mi nemůže sdělit úplné informace, protože web Prahy 1 má technická omezení přístupu. Zpozorněl jsem a začal zjišťovat, o jaká technická omezení se jedná. Jaké bylo moje překvapení, když jsem zjistil, že weby Portál městské části Praha 1 a Transparentní portál městské části Praha 1 jsou stále blokované pro přístup AI.

Portál:

robots.txt 2026-04-13

Transparentní:

robots.txt 2026-04-13

Napsal jsem tedy e-mail panu Burešovi, že jsem objevil tyto dvě nesrovnalosti, přičemž se zřejmě jedná o chybu IT oddělení, a vyjádřil jsem naději, že její odstranění nebude trvat měsíce jako v předchozím případě. E-mail jsem poslal v kopii panu Dvořákovi, se kterým jsem tuto záležitost v minulosti podrobně probíral. Navíc je nyní jedničkou na kandidátce ODS, na které kandiduje i pan radní.

Pan radní mi obratem odpověděl, že situaci prověří. Ve středu má pravidelnou schůzku s vedoucím IT odboru a dá mi obratem vědět. Na to jsem reagoval, že není třeba takovou jednoduchou věc probírat na poradě. Tohle je zřejmě drobná chyba jednoho IT pracovníka, kterou může napravit během jediné minuty. Jedná se o jednoduché smazání části textu ve třech souborech. Cenzurovat občanům přístup k webu přes AI je jistě omyl, ne záměr. A určitě se nikdo z nás nechce dostat do situace jako před několika měsíci, kdy úřad tajně přístup blokoval a na dotazy prakticky nereagoval.

Ve středu ráno do konverzace vstoupil pan Dvořák s připomenutím, že by měl pan Bureš odpovědět.

V pondělí v poledne je situace beze změny. Blokace dále trvá, reakce od pana Bureše žádná. Napsal jsem mu email, že jsem jeho přístupem zklamaný, a že to nechci dále řešit, jelikž nehodlám věnovat tolik času urgencím, jako na podzim.

Na vebu https://transparentni.praha1.cz/ zmizel soubor robots.txt. — Michal Rubeš 2026/04/22 15:25

  • temata/blokace-ai/start.txt
  • Poslední úprava: 2026/04/22 15:26
  • autor: Michal Rubeš