Náš robot
Tuto stránku najdete proto, že se vám v logu objevil návštěvník, který se podepsal odkazem sem. To je záměr: kdo k vám chodí, má říct, kdo je.
Kdo to je
- Podpis
Praha-X/0.1 (+https://praha-x.cz/bot)- Provozuje
- Praha-X.cz — městská paměť Prahy a českých krajů
- Odkud chodí
- z našich vlastních adres; server je v Evropské unii
Co dělá
Čte veřejně vydané zprávy: RSS a Atom kanály úřadů a městských částí, úřední desky, tiskové zprávy institucí a firem. Z nich si bereme titulek, datum, odkaz a krátký kontext, abychom o události mohli napsat vlastní větu s odkazem na vás jako na zdroj. Cizí texty nepřetiskujeme.
U zpráv, o kterých píšeme, robot jednou otevře i stránku článku,
na kterou kanál odkazuje, a přečte z ní text jako podklad pro vlastní shrnutí.
Ten text zůstává u nás jako pracovní materiál a na webu se neobjeví. Výhradu
vytěžování textů a dat respektujeme (tdm-reservation, protokol TDMRep):
kde je vyslovena, text nebereme.
Jak se chová
- Respektuje
robots.txt— co je zakázané, nečteme. - Chodí pomalu: kanály několikrát denně, stránku článku jen jednou, nejvýš jeden požadavek za tři sekundy na jeden web, bez paralelních spojení a bez procházení celého webu.
- Neobchází ochrany. Když nás odmítnete — kódem 403, 429 nebo kontrolní stránkou — přestaneme a zapíšeme si zdroj jako uzavřený. Nezkoušíme jiné adresy ani jiné podpisy.
- Nevydává se za prohlížeč a nevyplňuje formuláře.
- Nesbírá osobní údaje nad rámec toho, co je ve veřejně vydané zprávě.
Nechcete nás
Stačí řádek ve vašem robots.txt — přečteme ho a odejdeme:
User-agent: Praha-X
Disallow: /
Nebo nám napište formulářem pro podněty a zdroj vyřadíme ručně. Odpovídáme lidem, ne robotům.
In English
Praha-X/0.1 is the crawler of Praha-X.cz, a city-memory project for
Prague and the Czech regions. It reads publicly published feeds and press
releases, takes the headline, date, link and a short context, and writes its own
sentence citing you as the source. For stories we write about, it opens the
linked article page once and reads its text as working material for our own
summary; that text is never published, and a text-and-data-mining reservation
(tdm-reservation, TDMRep) is respected. It obeys robots.txt,
makes a single slow request at a time (at most one every three seconds per site),
does not pretend to be a browser and never works
around a block: a refusal is recorded as a closed source, not as a puzzle.
To keep it away, add User-agent: Praha-X / Disallow: /
to your robots.txt, or write to us through the
contact form (in Czech).
Praha-X.cz · Kronika · Právní informace · Soukromí · Legal notice