Diskuze: PHP search engine
V předchozím kvízu, Online test znalostí PHP, jsme si ověřili nabyté zkušenosti z kurzu.


Zobrazeno 6 zpráv z 6.
K personalizaci obsahu a reklam, poskytování funkcí sociálních médií a analýze naší návštěvnosti využíváme soubory cookie. Informace o tom, jak náš web používáte, sdílíme se svými partnery pro sociální média, inzerci a analýzy. Partneři tyto údaje mohou zkombinovat s dalšími informacemi, které jste jim poskytli nebo které získali v důsledku toho, že používáte jejich služby.
Používáme nezbytné cookies pro fungování webu a s tvým souhlasem také analytické a marketingové cookies.
Zajišťují základní funkce, bezpečnost a služby, které sis vyžádal. Nelze je vypnout.
| Služba | Poskytovatel | Účel | Cookies a úložiště | Doba uložení |
|---|---|---|---|---|
| ITnetwork | ITnetwork | Provoz webu, relace, přihlášení a uložení nastavení cookies. | PHPSESSID, auth_token, sid, itn_consent_impression, __Host-itn_consent | Relace až 1 rok |
| Google Tag Manager | Správa značek a načítání měřicích nástrojů webu. | Žádné | Neukládá se | |
| Google Fonts | Načítání typografie webu. | Úložiště řízené poskytovatelem | Dle podmínek poskytovatele | |
| Google Hosted Libraries | Načítání potřebných knihoven a stylů webu. | Úložiště řízené poskytovatelem | Dle podmínek poskytovatele | |
| Google reCAPTCHA | Ochrana formulářů a webu před zneužitím. | _GRECAPTCHA, rc::a, rc::b, rc::c, rc::f | Relace až 180 dní | |
| YouTube | Přehrávání vloženého video obsahu. | localStorage, IndexedDB; cookies after playback interaction | Relace až trvalé úložiště | |
| Vimeo | Vimeo | Přehrávání vloženého video obsahu. | __cf_bm, _cfuvid, vuid, localStorage, IndexedDB | Relace až 2 roky |
| Facebook Login | Meta | Přihlášení pomocí účtu třetí strany. | Úložiště řízené poskytovatelem | Relace až 1 rok |
| GoPay | GoPay | Zpracování uživatelem vyžádané platby. | Úložiště řízené poskytovatelem | Dle podmínek poskytovatele |
Pomáhají nám porozumět používání webu a zlepšovat ho.
| Služba | Poskytovatel | Účel | Cookies a úložiště | Doba uložení |
|---|---|---|---|---|
| Google Analytics 4 | Měření návštěvnosti a používání webu. | _ga, _ga_* | Až 2 roky | |
| Microsoft Clarity | Microsoft | Měření návštěvnosti a používání webu. | _clck, _clsk, _cltk | Relace až 1 rok |
Slouží k měření kampaní, personalizaci reklamy a marketingové komunikaci.
| Služba | Poskytovatel | Účel | Cookies a úložiště | Doba uložení |
|---|---|---|---|---|
| Google Ads | Měření kampaní, reklama a remarketing. | _gcl_au, _gcl_ls | Relace až 90 dní | |
| Meta Pixel | Meta | Měření kampaní, reklama a remarketing. | _fbp, _fbc, localStorage | Až 90 dní |
| Sklik | Seznam.cz | Měření kampaní, reklama a remarketing. | retargeting, sid, szn:* | Relace až trvalé úložiště |
| LinkedIn Insight | Měření kampaní, reklama a remarketing. | bcookie, li_gc, lidc, __cf_bm | Relace až 1 rok | |
| Ecomail | Ecomail.cz | Měření kampaní, reklama a remarketing. | ecmid, Úložiště řízené poskytovatelem | Dle podmínek poskytovatele |
| Atribuce kampaní ITnetwork | ITnetwork | Přiřazení návštěvy a objednávky ke kampani. | campaign_clid[*], user_session_context | Až 1 rok |
V předchozím kvízu, Online test znalostí PHP, jsme si ověřili nabyté zkušenosti z kurzu.


Ahoj zkus:
$url="www.domenaKeZkoumani.cz";
$content=file_get_contents($url);
if($content==FALSE){
echo "obsah webu nelze nacist";exit;
}
$regular_expression_pattern="~[0-9]~";
$content=zbavitsepbilychznaku($content);
/*bude hledat na zdrojovem kodu domeny string: 1 nebo 2 nebo 3....*/
preg_match($regular_expression_pattern,$content,$match);
/*následný výpis proměné pokud je NULL nebylo nalezeno*/
var_dump($match);
Potřebuješ znalosti regulerních vyrazů. Aplikace nebude rychlá protože
musí stahovat celé html pak následně project regulérním výrazem u něj
nevým jak je to se složitostí. Pečlívě si ošetři mezery, konce řádků
a tabulátory v proměné $content.
Rozepiš mi klidně jen do zpráv co to je za projekt docela mně to zajímá
a je to fér za tu drobnout
radu:)


Díky, základy PHP mám, ale toto jsem nikdy neřešil. Zajímá mě to, kdybych chtěl někde na svém webu dát vyhledávat třeba destinaci a měl bych externí stránky cestovky, které nějak vytváří stránky zájezdu a já tu stránku definoval a na ní hledal požadovaný obsah a pak jej vypsal na svůj web i třeba s dalšimi informacemi, ale aby nebyla vidět cestovka.
Většinou parsuješ obsah webu jako XML. Vyhledávání je zbytečně pracné, když jde o konkrétní web a ty víš jak vypadá.
Hodně jednoduše a neoptimalizovaně:
1 Načetl by sis kód té prohledávané stránky
2 Vytahal by jsi pro tebe relevantní texty - vyházet pryč html tagy, menu,
hlavičku, patičku, případně i obrázky, odkazy, formuláře apod., ale
pořád si pokud možno udržovat nějaké dělení textu na části, aby ti
nezbyl jeden velký blok textu
3 Najít hledaný (nebo podobný) výraz a vypsat celý ten blok, kam patří,
případně to nějak dál zpracovat
Zobrazeno 6 zpráv z 6.