95match.cz ← zpět na hlavní

95matchBot

Našli jste 95matchBot v access logu a chcete vědět, co je zač? Tahle stránka to vysvětluje. Pokud si nepřejete, abychom váš web stahovali, napište nám a vyřadíme ho.

1. Co je 95matchBot

95matchBot je crawler platformy 95match.cz, která propojuje firmy hledající zaměstnance s lidmi, kteří hledají práci. Sbírá veřejně dostupné pracovní inzeráty, aby je uchazeči našli na jednom místě - u každého inzerátu odkazujeme zpět na původní zdroj.

2. Co stahujeme

3. Jak často a jak intenzivně

Chodíme jednou denně, kolem 03:00 UTC (05:00 středoevropského letního času). Mimo tenhle jeden běh na váš web nesaháme.

Během běhu stáhneme jednu stránku s přehledem pozic a k tomu detail jen u inzerátů, které jsou nové nebo se od minule změnily. Nezměněné inzeráty znovu nestahujeme. U typického webu s několika otevřenými pozicemi to znamená řádově jednotky požadavků denně.

Požadavky posíláme sekvenčně, jeden po druhém - nikdy paralelně a bez souběžných spojení.

4. Jak nás poznáte v logu

Tam, kde se identifikujeme, posíláme tento User-Agent:

95matchBot/1.0 (+https://95match.cz/bot)

Buďme upřímní: zatím ho posíláme jen z části našich zdrojů. Zbytek požadavků odchází s výchozím technickým User-Agentem našeho HTTP klienta (Symfony HttpClient (Curl)), který sám o sobě neprozradí, že jsme to my. A u několika málo webů, jejichž ochrana ani jeden z těchto řetězců nepropustí, posíláme běžný prohlížečový User-Agent (řetězec Chrome). Na tom, co děláme, to nic nemění - pořád čteme jen veřejné stránky s inzeráty, jednou denně. Pokud si nejste jistí, jestli požadavek přišel od nás, napište nám a ověříme to.

Řetězec 95matchBot je stabilní a neměníme ho. Neuvádíme rozsahy IP adres - běžíme v cloudu bez statických adres a slibovat vám rozsah, který se může změnit, by bylo horší než ho neuvádět vůbec.

5. Kontakt

Napište na bot@95match.cz. Ozveme se.

Pokud si nepřejete, abychom váš web stahovali, stačí napsat - vyřadíme ho a přestaneme na něj chodit. Nemusíte nic dokazovat ani vyplňovat. Stejně tak nám dejte vědět, když vám nesedí frekvence nebo rozsah, ať to nemusíte řešit blokací.


English

What 95matchBot is

95matchBot is the crawler of 95match.cz, a platform matching companies with job seekers. It collects publicly available job postings so candidates can find them in one place; every listing links back to its original source.

What we fetch

How often and how heavily

We visit once per day, around 03:00 UTC. Outside that single run we do not touch your site.

Per run we fetch one listing page plus detail pages only for postings that are new or have changed since the last run. Unchanged postings are not re-fetched. For a typical site with a handful of open positions this amounts to a few requests per day.

Requests are sent sequentially, one at a time - never in parallel, no concurrent connections.

How to identify us in your logs

Where we identify ourselves, we send this User-Agent:

95matchBot/1.0 (+https://95match.cz/bot)

To be straight with you: we currently send it from only some of our sources. Our remaining requests go out with our HTTP client's default User-Agent (Symfony HttpClient (Curl)), which does not identify us on its own. And on a handful of sites whose protection rejects both of those strings, we send a common browser User-Agent (a Chrome string). Nothing else about the visit changes - we still read only public job listing pages, once a day. If you are unsure whether a request came from us, email us and we will check.

The 95matchBot token is stable and will not change. We do not publish IP ranges - we run on cloud infrastructure without static addresses, and promising a range we cannot guarantee would be worse than publishing none.

Contact

Email bot@95match.cz and we will get back to you.

If you do not want us crawling your site, just say so - we will remove it and stop visiting. No proof or paperwork needed. The same goes if the frequency or scope does not work for you; tell us instead of having to block us.