Čo je rozšírenie Scraping Camel?#

Scraping Camel je rozšírenie, ktoré automaticky a priebežne prechádza (crawluje) webové stránky, sťahuje z nich informácie a tieto dáta ukladá do strojovo čitateľného dátového feedu (CSV) alebo ich poskytuje cez API iným rozšíreniam (napr. Mergado Marketing Buddy). Funguje ako serverový scraper, ktorý beží nonstop, čo znamená, že dáta sú neustále aktualizované bez nutnosti spúšťať softvér na lokálnom počítači.

Rozšírenie je ideálne na získavanie dát, ktoré nie sú dostupné v bežných produktových feedoch, ako sú informácie z kategórií, blogov, statických stránok alebo z webov, ktoré žiadne feedy nemajú.

Pre koho je vhodné:

  • PPC špecialisti – Na tvorbu automatizovaných kampaní (napr. DSA alebo Performance Max) na základe dát z celého webu.
  • SEO špecialisti – Na priebežný monitoring stránok, SEO audity a analýzy kľúčových slov v reálnom čase.
  • Majitelia e-shopov – Ktorí potrebujú vytvoriť produktové feedy tam, kde im ich systém neponúka, alebo chcú feedy doplniť o chýbajúce dáta (napr. parametre, skladovosť, obrázky).
  • Weby bez košíka – Ako sú katalógy služieb, magazíny, firemné prezentácie či veľkoobchodné katalógy, ktorým Scraping Camel umožní vstúpiť do sveta feed marketingu.
  • Content špecialisti a manažment – Na kontrolu výsledkov práce a získanie prehľadu o obsahu a štruktúre webových stránok.

Cena a fakturácia#

Cena rozšírenia je:

  • 37 € za mesiac pri mesačnej fakturácii,
  • 29,60 € za mesiac pri ročnej fakturácii.

Cena je stanovená pre jeden e-shop (v Mergade) a je fixná, bez ohľadu na počet vytvorených projektov (webových stránok) alebo analýz kľúčových slov.

Vzhľadom na technickú nadväznosť je rozšírenie fakturované v súlade so zvolenou frekvenciou fakturácie v Mergado Editore. Pre jednotlivé služby nie je možné zvoliť rôzne frekvencie fakturácie.

Rozšírenie Scraping Camel30-dňovú skúšobnú dobu zadarmo.

Je možné Scraping Camel zapnúť aj bez Mergada?#

Scraping Camel je možné používať aj bez plateného projektu v Mergade. Je však nutné vytvoriť si v Mergade účet na autorizáciu používateľov a fakturáciu a e-shop na správu prístupov používateľov. Oboje je možné v Mergade vytvoriť zadarmo aj bez plateného projektu.

Základné pojmy spojené s rozšírením Scraping Camel#

  • Scraper (Crawler) – Automatizovaný robot, ktorý beží nonstop na serveri, prechádza HTML kód stránok a extrahuje z neho dáta do strojovo čitateľnej podoby.
  • Kľúčové slovo – Výraz alebo slovné spojenie automaticky generované Scraping Camelom priamo z textu webovej stránky. Kľúčové slová charakterizujú obsah stránky a jej hlavnú tému.
  • Element – Konkrétne dátové pole nesúce informácie, ktoré Scraping Camel z webu sťahuje. Elementy sa delia na:
    • Systémové – Preddefinované bežné SEO prvky (Title, H1, Meta Description atď.).
    • Vlastné – Používateľom definované polia (napr. cena, skladovosť).
    • AI elementy – Polia generované umelou inteligenciou bez nutnosti manuálneho nastavenia (kľúčové slová, detekcia jazyka, počet slov).
  • Hromadné elementy – Špeciálny typ elementov, pri ktorých sa Scraping Camel nezastaví pri prvom náleze, ale uloží všetky výskyty na danej stránke.
  • Validátor – Podmienka alebo pravidlo, ktoré automaticky a nonstop kontroluje stav webu a upozorňuje na technické či SEO chyby.
  • Inverzný export – Špeciálny typ výstupného CSV súboru pre kľúčové slová, kde je primárnym kľúčom URL adresa, ku ktorej sú priradené všetky nájdené kľúčové slová (vhodné pre PPC kampane).
  • Skóre – Číselná hodnota vyjadrujúca mieru významu (relevanciu) kľúčového slova pre konkrétnu webovú stránku.
  • Fráza – Slovné spojenie dvoch a viac slov, ktoré používateľ definuje, aby bolo pri analýze spracúvané ako jeden celok (jedno kľúčové slovo).
  • Stop slová – Zoznam slov, ktoré majú byť pri generovaní kľúčových slov ignorované (napr. spojky, predložky alebo vlastný brand), aby bol výsledok čistejší.
  • Štítky – Nástroj na organizáciu a klastrovanie kľúčových slov do tematických skupín, napríklad podľa produktových kategórií.

Čo je potrebné na spustenie rozšírenia Scraping Camel#

  • Účet v Mergado Editore a v ňom vytvorený e-shop.
  • Preukázanie vzťahu k doméne – Scraping Camel nie je určený na scrapovanie cudzích webov či konkurencie. Preto je nutné overiť vlastníctvo domény, aby nedochádzalo k neoprávnenému scrapovaniu cudzích webov.
  • Vloženie a overenie sitemap.xml – Súbor sitemap je pre fungovanie rozšírenia nevyhnutný, pretože z neho Scraping Camel čerpá URL adresy na stiahnutie. Ak rozšírenie sitemapu automaticky nenájde, je nutné jej adresu vložiť ručne.

Hlavné funkcie#

1. Získavanie ľubovoľných dát z HTML webovej stránky#

Scraping Camel dokáže z webu získať akékoľvek informácie, ktoré štandardné feedy neobsahujú. Web priebežne prechádza a sťahuje informácie priamo zo zdrojového kódu stránok, ktoré následne ukladá do strojovo čitateľného CSV feedu. Nazbierané dáta ukladá do elementov:

  • Systémové elementy – Preddefinované prvky, ktoré je možné aktivovať jedným kliknutím. Patria sem desiatky SEO parametrov ako TITLE, H1, META_DESCRIPTION, HTTP_STATUS, informácie o mikroformátoch (Open Graph, Twitter cards) alebo ID meracích kódov (GTM, GA).
  • Vlastné elementy – Umožňujú získať špecifické dáta, ktoré systémové elementy nepokrývajú (napr. cena, skladovosť, parametre, autor článku či omrvinková navigácia). Definujete si ich sami buď pomocou regulárnych výrazov, alebo zadaním textu „pred a za“ požadovanou hodnotou.
  • Scraping Camel AI – Elementy generované umelou inteligenciou, ktoré automaticky analyzujú obsah bez nutnosti manuálneho nastavenia. Na rozdiel od bežných elementov teda neurčujete ich obsah vy, ale rozšírenie ho získa automaticky vďaka umelej inteligencii. Scraping Camel tak sám odhalí jazyk (SC_DETECTED_LANGUAGE), počet slov na stránke (SC_NUMBER_OF_WORDS), vygeneruje hlavný titulok stránky (SC_MAIN_TITLE) a tiež kľúčové slová pre danú stránku (SC_WORDS_COUNT, SC_WORDS_TUPLES_COUNT, SC_WORDS_AGG_MIN_FREQ_3). Zistite viac informácií o AI elementoch.

⚠️ Scraping Camel nevykresľuje JavaScript, funguje iba na báze HTML. Ak je obsah skrytý za skriptmi, rozšírenie ho nedokáže vybrať.

2. Hromadné elementy#

Na rozdiel od bežných elementov, ktoré uložia iba prvý výskyt v kóde, hromadné elementy uložia všetky výskyty na danej stránke. Vďaka tomu môžete získať:

  • Spätné odkazy – Získate zoznam všetkých odkazov na stránke vrátane ich textu a HTTP kódu cieľovej URL. Ľahko tak odhalíte napríklad nefunkčné odkazy.
  • Obrázky – Získate adresy všetkých obrázkov na stránke, ich alternatívne texty (alt), veľkosť súboru a typ obsahu. Táto funkcia je kľúčová na odhaľovanie nefunkčných odkazov (chyba 404) alebo príliš veľkých obrázkov, ktoré spomaľujú web.

3. Priebežná SEO validácia a monitoring#

Scraping Camel funguje ako SEO audit, ktorý beží nonstop na serveri. Obsahuje 35 systémových validátorov, ktoré neustále kontrolujú technický stav webu (napr. chýbajúce H1, príliš dlhé titulky, URL zakázané v robots.txt) a upozorňujú na chyby. Môžete si tiež vytvárať vlastné validátory na špecifické kontroly, ako je napríklad prítomnosť meracích kódov (GTM, GA) alebo overenie unikátnosti obsahu.

4. Automatizovaná analýza kľúčových slov#

Scraping Camel umožňuje vytvárať komplexné analýzy kľúčových slov z obsahu webu, ktoré sa samy aktualizujú pri každej zmene na stránkach.

5. Pokročilé riadenie scrapovania#

V Scraping Camelovi máte plnú kontrolu nad tým, ako a čo sa má z vášho webu sťahovať.

  • Filtrovanie URL – Môžete vylúčiť určité časti webu (napr. blog) a scrapovať tak iba vybrané sekcie (napr. kategórie), čo šetrí výkon servera a sprehľadňuje výstupný feed.
  • Limitovanie požiadaviek – Určíte frekvenciu a rýchlosť sťahovania, aby nedošlo k preťaženiu webu alebo zablokovaniu scrapera ochranou Anti-DDoS.
  • Plánovanie aktualizácií – Zvolíte, ako často má Scraping Camel kontrolovať zmeny na už stiahnutých stránkach (raz, denne, každé tri dni, týždenne, mesačne).

6. Univerzálne výstupy a API#

Všetky získané dáta sú dostupné v univerzálnom CSV súbore, ktorý je možné nahrať do Mergado Editora ako samostatný feed alebo ho pripojiť k existujúcemu projektu pomocou pravidla Import dátového súboru. Dáta sú takisto prístupné cez API, čo umožňuje ich využitie v AI nástrojoch, ako je napríklad Mergado Marketing Buddy.

Príklady využitia v praxi#

  • Automatizácia PPC kampaní (DSA a PMax) – Scraping Camel vytvára ideálne podklady pre dynamické reklamy vo vyhľadávaní (DSA) a kampane Performance Max. Poskytuje zoznamy URL s ich obsahom (tzv. page feedy) a „inverzné exporty“ s najrelevantnejšími kľúčovými slovami pre každú stránku.
  • Tvorba feedov pre weby bez košíka – Umožňuje zapojiť do feed marketingu aj katalógy, magazíny alebo realitné portály, ktoré bežne produktové feedy nemajú. Scraping Camel vytvorí dátový súbor priamo z ich HTML kódu.
  • Doplnenie chýbajúcich dát do existujúcich feedov – Ak váš e-shopový systém neexportuje do feedu dôležité parametre (napr. farbu, materiál, podrobnú skladovosť alebo produktové čísla), Scraping Camel ich vytiahne priamo z webu a následne ich môžete v Mergado Editore do feedu doplniť.
  • Príprava category feedov – Pomáha PPC špecialistom vytvárať špecifické kampane cielené na kategórie webu, pre ktoré e-shopy feedy štandardne negenerujú.
  • Nepretržitý on-page SEO audit – Namiesto jednorazových kontrol Scraping Camel automaticky a nepretržite stráži napríklad stav titulkov, nadpisov H1 či meta popiskov. Upozorní na ich absenciu, duplicity alebo nevhodnú dĺžku.
  • Data-driven SEO a biznisové reporty – Umožňuje špecialistom prepájať technické SEO parametre (napr. skóre kľúčových slov) s biznisovými informáciami (cena, marža, predaje) na strategické rozhodovanie.
  • Kontrola kvality obsahu – Pomocou AI odhaľuje stránky s príliš malým počtom slov, automaticky deteguje jazyk stránky (napr. nepreložené produkty od zahraničného dodávateľa) a generuje kľúčové slová vystihujúce tému stránky.
  • Audit odkazov a obrázkov – Prostredníctvom hromadných elementov identifikuje nefunkčné odkazy a obrázky (chyba 404), chýbajúce alternatívne texty (alt) alebo príliš veľké súbory obrázkov, ktoré spomaľujú web.
  • Monitoring technických elementov a meracích kódov – Overuje prítomnosť ID pre Google Analytics alebo Google Tag Manager na všetkých podstránkach, aby nedochádzalo k výpadkom v meraní dát.
  • Sledovanie zmien a nových stránok – Vďaka elementu DISCOVERED umožňuje vyfiltrovať stránky, ktoré na webe pribudli za posledný týždeň či mesiac, čo je užitočné pre prehľad o rozvoji veľkých projektov.

Prečo je nutné overiť vlastníctvo domény#

Overenie domény je nevyhnutným bezpečnostným krokom, ktorý musíte vykonať predtým, než Scraping Camel začne sťahovať dáta z vášho webu. Hlavným dôvodom je, že toto rozšírenie je určené výhradne na spracovanie vlastných webových stránok, prípadne stránok vašich klientov či partnerov.

Prečo je toto opatrenie zavedené?#

  • Zamedzenie scrapovania konkurencie – Cieľom rozšírenia nie je umožniť vyťažovanie cudzích databáz alebo sledovanie konkurenčných webov.
  • Právne a etické hľadisko – Vyťažovanie cudzích dát bez súhlasu majiteľa nemusí byť legálne a majiteľ webu by s takým dataminingom nemusel súhlasiť. Ak však so scrapovaním súhlasí (napr. váš veľkoobchodný dodávateľ), môže doménu overiť a tým vám prístup umožniť.
  • Ochrana súkromia a dát – Scraping Camel spracúva iba dáta z domén, ku ktorým používateľ preukázal vzťah, čo zaisťuje, že s nastavením rozšírenia pracuje vždy oprávnená osoba z vášho tímu alebo agentúry.
  • Správa prístupov – Vďaka väzbe na e-shop v Mergade je možné ľahko spravovať používateľské oprávnenia a v prípade ukončenia spolupráce odovzdať nastavenie aj s nascrapovanými dátami klientovi.

Ako doménu overiť?#

V sprievodcovi založením novej stránky si môžete vybrať jednu zo štyroch metód, ktorá vám najviac vyhovuje:

  1. Google Search Console (GSC) – Najjednoduchšia a najrýchlejšia metóda, najmä pre marketingových špecialistov a agentúry. Ak už máte k doméne v GSC prístup, Scraping Camel sa cez API spojí so službou Google a overí, či máte oprávnenie s doménou pracovať.
  2. DNS TXT záznam – Do nastavenia DNS u vášho správcu domény vložíte špecifický textový reťazec, ktorý vám Scraping Camel vygeneruje. Táto metóda je trvalá a nezávislá od zmien v kóde webu, je však nutné dať pozor na správne nastavenie subdomén (napr. www vs. bez www). Viac podrobností nájdete v článku Ako overiť vlastníctvo domény v Scraping Camel pomocou DNS.
  3. Meta značka – Do hlavičky zdrojového kódu webu (medzi značky a ) vložíte krátky kód. Tento spôsob je ideálny pre používateľov platforiem Shoptet a WordPress.
  4. HTML súbor – Na server vášho webu (do koreňového adresára) nahráte vygenerovaný HTML súbor. Scraping Camel si následne existenciu tohto súboru na vašej URL adrese overí.

Práca v Scraping Camelovi#

Aktiváciu rozšírenia vykonáte v Mergado Store: Chcem aktivovaťvyberte e-shop, pre ktorý chcete rozšírenie zapnúť → Zapnúť.

V rozhraní rozšírenia Scraping Camel uvidíte v menu dve hlavné sekcie:

  • Webové stránky
  • Kľúčové slová

Webové stránky#

Táto časť je primárnym miestom na správu vašich projektov (webových stránok). Uvidíte tu zoznam všetkých vytvorených webových stránok, pričom jedna položka v zozname zodpovedá dátam z jednej konkrétnej domény. Počet domén, ktoré môžete v jednej inštancii (jednom spustení) rozšírenia spracúvať, nie je obmedzený. V prípade agentúr však odporúčame používať rozšírenie oddelene – vždy pre jedného klienta jednu inštanciu Scraping Camela.

V hornej časti tejto sekcie nájdete tlačidlo Nová stránka, ktorým spustíte sprievodcu pridaním nového webu. Všetky nastavenia, ktoré vykonáte v sprievodcovi, môžete následne editovať v jednotlivých záložkách v rámci konkrétneho vytvoreného projektu.

Na efektívnu správu, najmä ak spravujete desiatky domén, môžete využiť filtrovanie, napríklad podľa dátumu vytvorenia (vhodné na monitoring zmien za posledný týždeň) alebo podľa stavu spracovania stránky. Filtre môžete využívať aj na jednotlivých záložkách v rámci konkrétneho projektu.

Kliknutím na konkrétny projekt (webovú stránku) sa potom zobrazí prehľadné rozhranie s niekoľkými záložkami – Prehľad, Export súborov, Stránky, Elementy, Hromadné elementy, Validácie, Nastavenia.

1. Prehľad#

Táto stránka slúži ako úvodná obrazovka projektu s najdôležitejšími údajmi. Uvidíte tu adresy výstupných feedov (exporty do CSV) a možnosť ich stiahnutia.

Môžete tu tiež sledovať stav sťahovania. Keďže Scraping Camel prechádza web ohľaduplne, aby ho nepreťažil alebo nebol zablokovaný ochranou Anti-DDoS, sťahovanie tisícov stránok trvá určitý čas v závislosti od vášho nastavenia limitov.

2. Export súborov#

Tu spravujete výstupné dáta, ktoré rozšírenie z webu získalo. Môžete vytvoriť ľubovoľné množstvo exportov (kliknutím na tlačidlo Vytvorte nový exportný súbor) s rôznymi názvami na rôzne účely (napr. feed pre DSA kampane alebo SEO analýzu). V nastavení exportu si sami zvolíte, ktoré elementy má výsledné CSV obsahovať, a určíte ich presné poradie.

3. Stránky#

Zoznam všetkých konkrétnych URL adries, ktoré Scraping Camel na vašom webe objavil. Po kliknutí na konkrétnu adresu uvidíte prehľad všetkých elementov s ich konkrétnymi hodnotami, ktoré sa na danej stránke podarilo stiahnuť.

4. Elementy#

Na tejto stránke nájdete zoznam elementov, ktoré ste definovali v sprievodcovi pri tvorbe novej webovej stránky. Ide o elementy, ktoré má Scraping Camel na webe hľadať. Kliknutím na každý konkrétny element zobrazíte hodnoty daného elementu pre jednotlivé stránky.

Kliknutím na Editovať elementy ich môžete upravovať. Vľavo sa vám potom zobrazí zoznam elementov a vpravo uvidíte náhľad HTML kódu stránky. Či sa elementy budú sťahovať alebo nie, určíte ich zakliknutím v zozname vľavo.

Elementy sú tu rozdelené do kategórií:

  • Nájdené elementy – Systémové elementy, ktoré sa Scraping Camelovi v HTML kóde podarilo nájsť.
  • Nenájdené elementy – Systémové elementy, ktoré sa Scraping Camelovi v HTML kóde nepodarilo nájsť.
  • AI elementy – Elementy generované umelou inteligenciou. Viac informácií v článku Čo je Scraping Camel AI?
  • Vlastné elementy – V tejto časti vytvárate vlastné elementy, ktorých hodnoty definujete buď regulárnymi výrazmi, alebo ako „text pred/za“.

5. Hromadné elementy#

Špeciálne elementy určené na sťahovanie dát, ktorých sa na jednej stránke vyskytuje viac. Na rozdiel od bežných elementov sa Scraping Camel pri prvom náleze nezastaví, ale uloží všetky výskyty na danej stránke. Ide o elementy:

  • IMAGES (Obrázky) – Obsahuje informácie o URL obrázka, jeho alternatívnom texte, veľkosti súboru a type (napr. image, jpg).
    💡 V prehľade na stránke Hromadné elementy sa veľkosť obrázkov zobrazuje v kilobajtoch (KB), v nastavení validačného pravidla sa však používajú bajty (B).
  • LINKS (Spätné odkazy) – Obsahuje informácie o cieľovej URL, texte vnútri odkazu a HTTP stavovom kóde cieľovej adresy.

Extrakcia týchto dát je výkonovo náročná, preto je nutné ich sťahovanie spúšťať ručne tlačidlom Spustiť extrahovanie.

Nad hromadnými elementmi možno spúšťať systémové aj vlastné validátory. Ľahko tak získate zoznamy nefunkčných obrázkov (chyba 404), obrázkov bez popisu alebo príliš veľkých súborov, ktoré spomaľujú načítanie webu.

6. Validácie#

Stránka slúži ako nepretržitý a komplexný SEO audit vášho webu, ktorý beží priamo na serveri. Na rozdiel od klasických desktopových nástrojov, ktoré musíte spúšťať ručne, Scraping Camel kontroluje stav webu automaticky v súlade s vaším plánom aktualizácie dát. Vzhľadom na to, že funguje online, k aktuálnym výsledkom validácií môže mať prístup viac členov tímu naraz.

Aktivujete tu až 35 systémových validátorov pokrývajúcich kľúčové SEO oblasti (napr. chýbajúci H1, príliš dlhé titulky, chýbajúci meta description, nefunkčné stránky a pod.). Tieto validátory je možné zapínať/vypínať a upravovať podľa svojich potrieb (tlačidlo Upraviť východiskové validátory).

Okrem toho môžete tiež vytvárať vlastné validátory na špecifické potreby (tlačidlo Nový vlastný validátor). Vďaka nim ľahko ustrážite napríklad prítomnosť meracích kódov (GTM, GA), overíte unikátnosť obsahu alebo skontrolujete špecifické parametre, ako je autor článku alebo kategória.

Výsledky validácií uvidíte v prehľadnej tabuľke, kde sú zoradené podľa závažnosti a označené farebnými ikonami. Po rozkliknutí príslušného validátora sa vypíše zoznam všetkých URL, ktorých sa chyba/varovanie/upozornenie týka.

  • 🔴 Červená ikona (Vážna chyba): Kritické nedostatky, ktoré vyžadujú okamžitú pozornosť (napr. nefunkčná URL 404 alebo chýbajúci TITLE).
  • 🟠 Oranžová ikona (Varovanie): Chyby, ktoré by mali byť opravené, ale web je funkčný (napr. príliš dlhý Meta Description).
  • 🔘 Sivá ikona (Upozornenie/Informácia): Menej závažné stavy alebo odporúčania na vylepšenie.
  • 🟢 Zelené ikony (V poriadku): Zobrazujú sa pri validátoroch, kde žiadna z kontrolovaných položiek nespĺňa chybovú podmienku.

Aby bola validácia dát úspešná, musia byť na záložke Elementy aktivované (zaškrtnuté) tie elementy, ktoré má validátor kontrolovať (napr. ak chcete validovať H1, musí byť element H1 aktívny na sťahovanie). Rýchlosť aktualizácie validačných výsledkov sa odvíja od nastavenej frekvencie sťahovania stránok na záložke Nastavenia.

7. Nastavenia#

Na jednotlivých záložkách tu môžete upravovať technické parametre scrapovania.

a. Nastavenie stránok

Zmena názvu projektu alebo domény.

b. Limitovanie požiadaviek

Môžete zmeniť frekvenciu a rýchlosť, s akou bude Scraping Camel pristupovať k vášmu webu. Tieto parametre sú kľúčové na to, aby bol web spracovaný v rozumnom čase, ale zároveň nedošlo k jeho preťaženiu alebo k zablokovaniu scrapera ochranou Anti-DDoS.

  • Frekvencia sťahovania stránok – Ako často má Scraping Camel kontrolovať zmeny na stránkach, ktoré už raz úspešne stiahol a pozná ich. Zatiaľ čo nové stránky (ktoré sa v sitemape objavili prvýkrát) sa rozšírenie snaží stiahnuť čo najskôr (spravidla každý deň), pri známych stránkach si môžete vybrať z intervalov – iba raz (a už nikdy neaktualizovať), denne, každé tri dni, týždenne alebo mesačne.
  • Počet stiahnutí stránok v danom intervale – Definuje veľkosť dávky, teda koľko stránok sa má spracúvať naraz v rámci jedného časového úseku. Ak do tohto poľa zadáte napríklad hodnotu 5, znamená to, že rozšírenie v každom určenom časovom úseku vyšle požiadavku na stiahnutie 5 URL adries.
  • Interval sťahovania stránok – Určuje časový odstup medzi jednotlivými dávkami sťahovania. Ak teda nastavíte interval napríklad na 500 ms, rozšírenie sa každú pol sekundy pokúsi stiahnuť stanovený počet stránok (ktorý sme určili v kolónke Počet stiahnutí stránok v danom intervale).

c. Nastavenie AI

Správa parametrov na generovanie kľúčových slov a zoznamov stop-slov. Môžete tu definovať napríklad minimálnu dĺžku kľúčových slov, prah skóre (minimálny percentuálny význam, ktorý musí slovo mať, aby sa dostalo do výberu kľúčových slov), pravidlá na spracovanie číslic, stanoviť tzv. stop slová (výrazy, ktoré má AI pri tvorbe kľúčových slov celkom ignorovať) alebo definovať frázy (viacslovné spojenia, ktoré má algoritmus spracúvať dohromady ako jedno kľúčové slovo). Viac informácií v článku Čo je Scraping Camel AI?.

d. Pravidlá spracovania stránok

Pomocou pravidiel určíte, ktoré stránky majú byť sťahované (všetko ostatné bude ignorované) alebo naopak vylúčené zo sťahovania (stiahne sa všetko okrem nich). Môžete napríklad sťahovať iba kategórie a naopak vylúčiť stránky blogu. Výrazne to ušetrí výkon vášho servera, skráti čas aktualizácie dát a prečistí výstupný CSV feed od nepotrebných dát.

Podmienky na výber URL môžete definovať dvoma spôsobmi:

  • Reťazcom z URL – Zadáte časť adresy (napr. /blog/ alebo /produkt/).
  • Regulárnym výrazom – Na pokročilejšie a presnejšie filtrovanie (napr. pre URL končiace určitým číslom).

Stránky, ktoré nezodpovedajú vašim pravidlám, sa v zozname na záložke Stránky síce objavia (aby bol prehľad o obsahu sitemapy kompletný), ale budú označené červeným symbolom. Tieto stránky sa nebudú scrapovať ani exportovať do výstupných súborov.

Kľúčové slová#

Táto časť slúži na automatické generovanie a správu dátových feedov s kľúčovými slovami nájdenými priamo na vašich webových stránkach. Na rozdiel od sekcie Webové stránky, kde je primárnym kľúčom URL adresa, v tejto agende je východiskovým prvkom konkrétne kľúčové slovo, ku ktorému sú priradené relevantné stránky a metriky.

Na tejto stránke uvidíte zoznam všetkých vytvorených analýz kľúčových slov. Novú analýzu vytvoríte tlačidlom Nová analýza kľúčových slov, kde zvolíte doménu (jednu alebo aj viac), z ktorej sa majú dáta čerpať.

Po rozkliknutí konkrétnej analýzy sa zobrazí prehľadné rozhranie s niekoľkými záložkami – Prehľad, Export súborov, Štítky, Varianty, Diagnostika, Validácie a Nastavenia.

1. Prehľad#

Nájdete tu zoznam všetkých nájdených kľúčových slov. Pri každom kľúčovom slove v tabuľke uvidíte:

  • jeho znenie (element KEYWORD),
  • URL vstupnej stránky, ktorá má pre dané slovo najvyššiu nameranú relevanciu, t. j. najvyššie skóre (element URL),
  • číselnú hodnotu vyjadrujúcu najvyššie skóre relevancie pre vstupnú stránku k danému slovu (element TOP_SCORE),
  • počet všetkých stránok na webe, na ktorých sa toto slovo dostalo medzi top kľúčové slová, t. j. prekročilo nastavenú hranicu významu (element PAGES_COUNT),
  • údaje o hľadanosti a CPC (cene za preklik), ak sú pre dané slovo dostupné,
  • status, t. j. či je kľúčové slovo aktívne alebo nie,
  • či sú k nemu priradené štítky,
  • dátum a čas prvého nálezu.

Zo zoznamu sa dá prekliknúť priamo do SERP Google, aby ste si overili reálne výsledky vyhľadávania pre daný výraz. Jednotlivé slová môžete v zozname aktivovať alebo deaktivovať, čo sa následne prejaví v exporte. Po kliknutí na kľúčové slovo sa zobrazí zoznam všetkých stránok relevantných pre dané kľúčové slovo.

2. Export súborov#

V tejto časti môžete spravovať a exportovať CSV súbory na analýzu kľúčových slov. Na export vyberiete elementy, ktoré majú byť v súbore obsiahnuté, a zvolíte ich poradie. Na výber máte dva typy exportov:

  • Klasický export (tlačidlo Vytvoriť klasický exportný súbor) – Tabuľka, kde je každému kľúčovému slovu venovaný jeden riadok so zvolenými doplňujúcimi informáciami.
  • Inverzný export (tlačidlo Vytvoriť inverzný exportný súbor) – Špeciálny formát, ktorý dáta „otočí“. Primárnym kľúčom je URL adresa, ku ktorej sú v ďalšom stĺpci priradené všetky relevantné kľúčové slová. Tento formát je ideálny na tvorbu DSA kampaní alebo Performance Max kampaní v Google Ads.

3. Štítky#

Slúžia na organizáciu kľúčových slov do tematických skupín. Pri e-shopoch sa najčastejšie využívajú na rozdelenie slov podľa produktových kategórií (napr. štítok „chladničky“, „práčky“ a pod.). Štítky možno k slovám priraďovať hromadne alebo jednotlivo v detaile kľúčového slova.

Po rozkliknutí štítka sa zobrazí zoznam k nemu priradených kľúčových slov.

4. Varianty#

Táto záložka slúži na ručné zjednocovanie rôznych tvarov toho istého slova. Scraping Camel sa síce automaticky snaží rozpoznať, že napríklad slová ako „práčka“, „práčky“ alebo „práčkou“ k sebe patria, ale občas mu nejaký zložitejší tvar alebo skloňovanie unikne.

V tejto sekcii môžete systému ručne napovedať a spojiť tieto výrazy pod jedno hlavné slovo. Napríklad určiť, že slovo „agentúr“ má byť započítané ako variant slova „agentúra“. Výsledkom je oveľa čistejšia a prehľadnejšia analýza, v ktorej sa dáta netrieštia do mnohých podobných riadkov.

5. Diagnostika#

Diagnostika vám pomôže odhaliť, či texty na vašich stránkach skutočne hovoria o tom, čo predávate, alebo či sú zahltené nerelevantnými slovami, ktoré skresľujú výsledky analýzy.

Scraping Camel vezme všetky nájdené kľúčové slová (vrátane viacslovných fráz), rozdelí ich na jednotlivé slová a spočíta, koľkokrát sa ktoré z nich na celom webe vyskytuje. Vďaka tomu okamžite uvidíte, aké slová na vašom webe dominujú.

Ak zistíte, že najčastejším slovom na vašom e-shope je napríklad „DPH“, „cookies“ alebo „skladom“, je to pre vás dôležitý signál. Znamená to, že tieto technické alebo všeobecné slová v analýze „prebíjajú“ dôležité kľúčové slová, ktoré skutočne vystihujú vaše produkty. Len čo v diagnostike také výrazy odhalíte, môžete ich v záložke Validácie pridať medzi stop slová. Tým analýzu vyčistíte a v prehľade vám zostanú len tie slová, ktoré majú pre váš marketing skutočný význam.

6. Validácie#

Záložka Validácie slúži na automatické prečisťovanie, organizáciu a zvyšovanie kvality celého vášho datasetu kľúčových slov. Môžete tu nastaviť validačné pravidlá (validátory), vďaka ktorým zaistíte, že výsledný export kľúčových slov bude maximálne relevantný pre váš marketing a nebude obsahovať zbytočné dáta. Vďaka validátorom sa dataset čistí priebežne a automaticky na pozadí, takže zostáva kvalitný bez nutnosti neustálych ručných zásahov.

Pomocou validačných pravidiel môžete hromadne nastaviť napríklad:

  • Zakázanie slov (stop slová) – Ak v analýze identifikujete slová, ktoré pre vás nie sú prínosné (napr. všeobecné výrazy ako „DPH“, „skladom“, „košík“ alebo váš vlastný brand, ktorý prebíja unikátne kľúčové slová), môžete tu nastaviť pravidlá na ich trvalé vylúčenie z analýzy.
  • Spájanie do fráz – Môžete definovať pravidlá, ktoré spoja dve a viac slov do jedného celku (frázy), napr. „Bidding Fox“ alebo „Google Analytics“. Scraping Camel potom s týmito frázami pracuje ako s jedným kľúčovým slovom, čo zvyšuje presnosť scoringu a relevanciu výsledkov.
  • Automatické štítkovanie – Pomocou validátorov môžete tiež automaticky priraďovať štítky ku kľúčovým slovám na základe definovaných podmienok. To je zásadné pre tzv. klastrovanie, teda zoskupovanie slov do logických celkov, napríklad podľa produktových skupín (chladničky, práčky, mobilné telefóny).

7. Nastavenia#

V Nastaveniach upravíte základné parametre analýzy, ako je jej názov alebo zoznam ignorovaných znakov. Táto funkcia je kľúčová na odstránenie nežiaducich prvkov z textov, z ktorých sa kľúčové slová generujú. Umožňuje definovať zoznam konkrétnych symbolov a znakov, ktoré má Scraping Camel pri analýze celkom prehliadať. Zaistíte tak väčšiu čistotu dát a zabránite vytváraniu nerelevantných kľúčových slov.

Všetky tu uvedené parametre nastavujete v sprievodcovi pri zakladaní novej analýzy. V tej chvíli volíte tiež jednu alebo viac webových stránok, z ktorých sa majú dáta čerpať. Toto nastavenie je platné navždy a nedá sa v záložke Nastavenia neskôr zmeniť. Ak potrebujete analyzovať inú doménu, musíte vytvoriť celkom novú analýzu.

Ochrana súkromia a nakladanie s dátami#

Scraping Camel spracúva výhradne dáta z verejne dostupných webových stránok, pri ktorých používateľ preukázateľne overil svoje vlastníctvo alebo vzťah k doméne. Všetky získané dáta sa považujú za súkromné, neposkytujú sa žiadnym tretím stranám a používateľ má ich rozsah plne pod kontrolou priamo v administrácii rozšírenia. V prípade zmazania projektu sú všetky súvisiace dáta do 14 dní definitívne odstránené aj zo záložných systémov, ktoré slúžia len na obnovu rozšírenia pri technických poruchách.

FAQ#

Čo je Scraping Camel a na čo slúži?#

Scraping Camel je rozšírenie, ktoré automaticky a priebežne prechádza webové stránky, sťahuje z nich dáta a ukladá ich do CSV feedu alebo ich poskytuje cez API. Beží nonstop na serveri, takže dáta sú neustále aktualizované bez nutnosti ručne spúšťať softvér na vašom počítači. Hodí sa všade tam, kde potrebujete získať dáta, ktoré nie sú dostupné v bežných produktových feedoch.

Pre koho je Scraping Camel vhodný?#

Využijú ho predovšetkým PPC a SEO špecialisti, majitelia e-shopov, správcovia webov bez košíka (katalógy, magazíny, firemné weby) aj content manažéri. Nástroj je univerzálny – pomôže s automatizovanou tvorbou kampaní, SEO auditmi, analýzou kľúčových slov aj kontrolou kvality obsahu.

Koľko Scraping Camel stojí?#

Cena je 37 € mesačne pri mesačnej fakturácii alebo 29,60 € mesačne pri ročnej fakturácii. Cena je fixná pre jeden e-shop bez ohľadu na počet vytvorených projektov (webových stránok) alebo analýz kľúčových slov. K dispozícii je 30-dňová skúšobná doba zadarmo.

Musím mať platený projekt v Mergade, aby mi Scraping Camel fungoval?#

Nie. Scraping Camel možno používať aj bez plateného projektu v Mergade. Stačí si zadarmo vytvoriť Mergado účet a v ňom e-shop kvôli prihláseniu, fakturácii a správe prístupov.

Aké sú podmienky na spustenie Scraping Camela?#

Potrebujete tri veci – Mergado účet s e-shopom, overené vlastníctvo domény, ktorú chcete scrapovať, a funkčný súbor sitemap.xml, z ktorého rozšírenie čerpá zoznam URL adries.

Prečo musím overovať vlastníctvo domény?#

Scraping Camel je určený výhradne na spracovanie vlastných webov alebo webov vašich klientov. Overenie domény bráni zneužitiu nástroja na scrapovanie cudzích či konkurenčných webov a zaisťuje, že s dátami pracuje vždy oprávnená osoba.

Ako môžem doménu overiť?#

Sú k dispozícii štyri metódy: cez Google Search Console (najrýchlejšia varianta pre agentúry), cez DNS TXT záznam (trvalá metóda nezávislá od kódu webu), vložením meta značky do hlavičky webu (vhodné pre Shoptet a WordPress) alebo nahraním HTML súboru na server.

Funguje Scraping Camel aj na weboch postavených na JavaScripte?#

Nie. Rozšírenie pracuje iba s HTML kódom stránok a JavaScript nevykresľuje. Ak je akýkoľvek obsah stránky závislý od JavaScriptu, Scraping Camel ho nedokáže extrahovať.

Aké dáta možno pomocou Scraping Camela získať?#

Prakticky čokoľvek, čo je obsiahnuté v HTML kóde stránky. Dáta sa potom ukladajú buď do preddefinovaných systémových elementov (Title, H1, Meta Description, HTTP status, GTM/GA kódy a i.), vlastných elementov definovaných regulárnym výrazom alebo textom „pred a za“, alebo do automaticky generovaných AI elementov (kľúčové slová, jazyk stránky, počet slov, titulok stránky).

Čo sú hromadné elementy a čím sa líšia od bežných?#

Do bežného elementu sa uloží prvý výskyt danej hodnoty na stránke. Hromadné elementy uložia všetky výskyty. Konkrétne ukladajú kompletný zoznam všetkých obrázkov (vrátane alt textov a veľkosti súboru) alebo všetkých odkazov (vrátane HTTP stavových kódov) na danej stránke. Sťahovanie informácií do týchto elementov sa spúšťa ručne, pretože je výkonovo náročnejšie.

Ako funguje SEO validácia v Scraping Camelovi?#

Scraping Camel obsahuje 35 systémových validátorov, ktoré nepretržite kontrolujú technický stav webu a upozorňujú na chyby ako chýbajúci H1, príliš dlhé titulky alebo nefunkčné stránky. Výsledky sú farebne rozlíšené podľa závažnosti a sú prístupné online. Popri systémových validátoroch si môžete vytvárať aj vlastné.

Ako Scraping Camel pomôže s PPC kampaňami?#

Vytvára page feedy s URL adresami a ich obsahom, ktoré sú ideálne pre DSA kampane a Performance Max. Je možné získať aj inverzné exporty kľúčových slov – CSV súbory, kde je primárnym kľúčom URL adresa a k nej sú priradené všetky relevantné kľúčové slová.

Môžem scrapovať len časť webu, napríklad len kategórie?#

Áno. V nastavení pravidiel spracovania stránok určíte, ktoré časti webu sa majú scrapovať a ktoré ignorovať — napríklad vylúčite blog a spracujete len kategórie. Podmienky možno definovať reťazcom z URL alebo regulárnym výrazom.

Ako rýchlo Scraping Camel dáta aktualizuje?#

Nové stránky, ktoré sa prvýkrát objavia v sitemape, sa rozšírenie snaží stiahnuť spravidla každý deň. Pri už známych stránkach si sami zvolíte frekvenciu – raz, denne, každé tri dni, týždenne alebo mesačne. Rýchlosť možno ďalej ovplyvniť nastavením počtu stiahnutí v dávke a intervalu medzi dávkami.

V akom formáte sú dostupné výstupné dáta?#

Dáta sú exportované ako CSV súbor, ktorý je možné nahrať do Mergado Editora ako samostatný feed alebo pripojiť k existujúcemu projektu pomocou pravidla Import dátového súboru. Dáta sú prístupné aj cez API, napríklad pre rozšírenie Mergado Marketing Buddy.

Môžem v rámci jedného spustenia rozšírenia scrapovať viac webov?#

Áno, počet domén v rámci jedného spustenia nie je obmedzený. Pre agentúry spravujúce weby viacerých klientov sa však odporúča spustiť pre každého klienta samostatnú inštanciu rozšírenia – uľahčí to správu prístupov a odovzdanie dát pri ukončení spolupráce.

Čo sa stane s mojimi dátami, ak projekt zmažem?#

Po zmazaní projektu sú všetky súvisiace dáta do 14 dní trvale odstránené aj zo záložných systémov. Scraping Camel spracúva výhradne dáta z verejne dostupných stránok s overeným vlastníctvom a neposkytuje ich žiadnym tretím stranám.

Ako funguje analýza kľúčových slov v Scraping Camelovi?#

V sekcii Kľúčové slová vytvoríte analýzu pre jednu alebo viac domén. Scraping Camel automaticky generuje kľúčové slová z obsahu stránok, priraďuje im skóre relevancie a priebežne ich aktualizuje. Dáta možno triediť pomocou štítkov, zjednocovať rôzne tvary slov cez varianty, čistiť pomocou stop slov a exportovať ako klasický alebo inverzný CSV súbor.

Ako spoznám, že moja analýza kľúčových slov obsahuje nerelevantné slová?#

Na to slúži záložka Diagnostika. Scraping Camel v nej zobrazí, ktoré slová sa na vašom webe vyskytujú najčastejšie. Ak medzi nimi dominujú všeobecné výrazy ako „DPH“ alebo „cookies“, je to signál, že tieto slová prebíjajú relevantné kľúčové slová a mali by byť pridané na zoznam tzv. stop slov.

Bol tento článok užitočný?