A „duplikált tartalom büntetés” az a SEO-mítosz, amit maga a Google sorol a mítoszai közé — külön alcím alatt, a saját kezdő útmutatójában. A válasz tehát rövid, és nemleges. Ami helyette történik, viszont érdemes megérteni, mert a webshopokat és a fordított oldalakat közvetlenül érinti.
Nincs büntetés — és ezt a Google mondja
A kezdő útmutató „SEO-mítoszok” szakaszából, a Duplikált tartalom „büntetés” alcím alatt: „Ha van olyan tartalmad, ami több URL-en is elérhető, az rendben van; ne izgulj miatta. Nem hatékony, de nem olyasmi, ami manuális intézkedést okozna. Mások tartalmának másolása viszont más történet.”
Ugyanez máshol: „Duplikált tartalom a webhelyeden nem sérti a spam-szabályzatunkat, de rossz felhasználói élményt jelenthet, és a keresőmotorok feltérképezési erőforrásokat pazarolhatnak olyan URL-ekre, amelyek téged sem érdekelnek.” A Google 2008-as, máig élő bejegyzése pedig még ennél is határozottabb: „Tegyük ezt egyszer és mindenkorra ágyba, emberek: nincs olyan, hogy »duplikált tartalom büntetés«.”
Ami helyette történik: a Google klaszterezi az azonos URL-eket, kiválasztja közülük a szerinte legjobbat, és a klaszter tulajdonságait — például a linkek népszerűségét — összevonja arra az egy URL-re. A valódi kár tehát három dolog: nem feltétlenül a te preferált URL-ed jelenik meg; a fel nem ismert duplikátumnál a jelzések szétaprózódnak; és feleslegesen fogy a feltérképezési keret.
És egy szám, ami nem létezik: nincs semmilyen hasonlósági küszöb. Sem 30%, sem 20, sem 70 — se százalék, se szóhossz, se mondatszám. A Google klaszterez és választ, nem egyezést mér.
A canonical jelzés, nem utasítás
A kanonizálás hivatalos definíciója: „a folyamat, amelynek során kiválasztjuk egy tartalom reprezentatív — kanonikus — URL-jét.” A Google a saját jelzései alapján dönt, és a döntése felülírhatja a tiédet: „Jelezheted a preferenciádat a Google-nek ezekkel a technikákkal, de a Google különböző okokból választhat más oldalt kanonikusnak, mint te. Vagyis a kanonikus preferencia jelzése egy jelzés, nem szabály.”
A jelzések erősorrendben: az átirányítás erős jelzés, a rel="canonical" szintén erős, az oldaltérképben való szerepeltetés gyenge. Ezek egymásra épülnek — kombinálva hatékonyabbak.
És ami a legmeglepőbb: nem kötelező. Szó szerint: „Bár bátorítunk, hogy használd ezeket a módszereket, egyik sem kötelező; a webhelyed valószínűleg jól elboldogul kanonikus preferencia megadása nélkül is.” Ha nem adod meg, a Google maga választ.
Amit viszont kifejezetten tilt: a robots.txt-t kanonizálásra használni; az URL-eltávolító eszközt kanonizálásra használni; és a noindex-et egy webhelyen belüli kanonikus választás megakadályozására, „mert az teljesen kizárja az oldalt a Keresőből”.
A Search Console „Duplikált” sorai nem hibák
Ez az a pont, ahol a legtöbb felesleges munka születik. Az „Oldalak indexelése” jelentés általános elve a Google szavaival: „Ha egy oldal duplikáltnak vagy alternatívnak van jelölve, az általában jó dolog; azt jelenti, hogy megtaláltuk a kanonikus oldalt, és indexeltük.”
- ◆Duplikált, a felhasználó nem jelölt ki kanonikus oldalt„Ez nem hiba, hanem a szándék szerint működik, mert a Google nem szolgál ki duplikált oldalakat.” Teendő csak akkor, ha szerinted rossz URL-t választott.
- ◆Duplikált, a Google más kanonikust választottNézd meg az URL-ellenőrzőben a Google által választott és az általad megadott URL-t. „Ha a felhasználó által megadott kanonikus nem hasonlít az aktuális oldalra, akkor a Google soha nem fogja azt az URL-t kanonikusnak választani.”
- ◆Alternatív oldal megfelelő canonical címkévelSzó szerint: „nincs semmi teendőd.” Figyelem: a más nyelvű változatokat a Search Console nem észleli.
- ◆Amit az élő teszt nem mutat meg„A duplikációs vagy kanonikus állapotokat az élő teszt nem vizsgálja” — ezért ne az URL-ellenőrző élő tesztjéből próbáld kiolvasni.
Webshop: szűrők, változatok, lapozás
Itt ma már nem büntetés-kérdésről van szó, hanem feltérképezésről. A szűrők és rendezések által generált URL-ekre a Google ajánlása: ha nem akarod, hogy indexelődjenek, akadályozd meg a feltérképezésüket robots.txt-vel, vagy tiltsd az indexelést noindex robots meta címkével. Ha a szűrőd URL-töredékre épül (a # utáni rész), akkor „nincs hatással a feltérképezésre”.
Termékváltozatoknál (méret, szín) a Google két URL-szerkezetet ajánl: útvonalszakaszt (/polo/zold) vagy lekérdezési paramétert (/polo?szin=zold). És egy hasznos részlet: „használd a paraméter nélküli URL-t kanonikus URL-ként. Ez segíthet a Google-nek jobban megérteni a termékváltozatok közötti kapcsolatot.”
„Állítsd be a paramétereket a Search Console-ban.” Az URL-paraméter eszközt a Google 2022 áprilisában kivezette. Az indoklás: „a jelenleg megadott paraméter-konfigurációknak csak körülbelül 1%-a hasznos a feltérképezéshez”, és „a Google feltérképezői automatikusan megtanulják kezelni az URL-paramétereket”. Marad a robots.txt, a noindex és a canonical. „A lapozott oldalakat canonicalold az elsőre.” Ez kifejezetten tiltott: „Ne használd a lapozott sorozat első oldalát kanonikus oldalként. Ehelyett adj minden oldalnak saját kanonikus URL-t.” (Címeket és leírásokat viszont nyugodtan használhatsz ugyanazokat.) „Használd a rel=next/prev-et.” Elavult: „A Google már nem használja ezeket a címkéket.”
Átvett tartalom, fordítás, másolás
Szindikáció. Itt változott a hivatalos tanács, és a magyar SEO-anyagok többsége még a régit ismétli. A mai szöveg: „A kanonikus link elem nem ajánlott azoknak, akik el akarják kerülni a szindikációs partnerek általi duplikációt, mert az oldalak gyakran nagyon különbözőek. A leghatékonyabb megoldás az, ha a partnerek letiltják a tartalmad indexelését.” Vagyis a partner noindex-e a megoldás, nem a domainek közötti canonical.
Fordítás. A lefordított oldal nem duplikáció: „Egy oldal lokalizált változatai csak akkor számítanak duplikátumnak, ha az oldal fő tartalma lefordítatlan marad.” Ha csak a fejléc és a lábléc van lefordítva, a törzs viszont ugyanaz, akkor duplikátum — egyébként nem. Azonos nyelvű országváltozatoknál a Google a kanonizálás és a hreflang együttes használatát ajánlja.
Ha téged másolnak. A spam-szabályzat a „scraping”-et így definiálja: „tartalom átvétele más oldalakról, gyakran automatizált módon, és annak közzététele a keresési rangsorok manipulálása céljából.” Példák közte: eredeti tartalom vagy érték hozzáadása nélküli újraközlés, akár a forrás megjelölése nélkül; enyhe módosítással (szinonimacserével) történő újraközlés. De az irány számít: a Google szerint az, hogy mások másolnak téged, „más történet” — nincs miatta szankció. A kockázat az, hogy a Google a másik példányt választja kanonikusnak.
Bejelentésre két út van: az általános spam-bejelentés (figyelem, a Google jelzi, hogy a beküldött szöveget el kell küldenie az oldal tulajdonosának, ezért személyes adatot ne írj bele), illetve szerzői jogi sérelemnél a külön DMCA-eljárás. A régi külön „scraper report” űrlap már nem létezik.
Gyakori kérdések
Hány százalék egyezéstől számít duplikáltnak?
Semennyitől — ilyen küszöb nem létezik a Google dokumentációjában. A Google csoportosít és választ, nem hasonlóságot mér százalékban.
Kell minden oldalhoz canonical?
Nem kötelező: „egyik sem kötelező; a webhelyed valószínűleg jól elboldogul kanonikus preferencia megadása nélkül is.” Az önhivatkozó canonicalt a kanonikus oldalon viszont ajánlja a Google.
Büntet, ha a gyártó leírását használom a termékoldalon?
Önmagában nem szabálysértés. Ami szankcionálható, az a „vékony társult” minta: érték hozzáadása nélküli, másolt termékleírás társult linkekkel. A gyakorlati kérdés inkább az, hogyan előznéd meg azt a boltot, aki ugyanazt a szöveget használja.
Mi van, ha a cikkemet máshol újraközlik?
Nem jár érte szankció. Ha el akarod kerülni, hogy a másik példány nyerjen, kérd a partnert, hogy tiltsa le az indexelést — ez ma a hivatalos ajánlás, nem a domainek közötti canonical.
A fordított oldalam duplikált tartalom?
Nem, ha a fő tartalom is le van fordítva. Csak akkor, ha csupán a sablon (menü, lábléc) fordul, a törzs pedig változatlan marad.
A duplikáció gyakran a címeknél kezdődik — arról, mit használ a Google a találati címhez, külön cikk szól. A tartalom minőségi oldalát pedig ez a cikk foglalja össze.
Ha webshopod van, és nem tudod eldönteni, mely URL-eknek kellene indexelődniük: kérj ajánlatot, és átnézzük.
Források: Google Search Central — SEO kezdő útmutató (SEO-mítoszok, Duplikált tartalom csökkentése); Kanonizálás; Kanonikus URL megadása; Kanonizálási problémák javítása (Syndicated content); Spam-szabályzat (Scraping, Thin affiliate); Lokalizált változatok és hreflang; Fazettás navigációs URL-ek feltérképezésének kezelése; E-kereskedelem: lapozás és fokozatos oldalbetöltés; E-kereskedelmi URL-szerkezet; URL-szerkezet bevált gyakorlatok; Search Central Blog — „Demystifying the duplicate content penalty” (2008. szeptember), „Spring cleaning: the URL Parameters tool” (2022. március); Search Console Súgó — Oldalak indexelése jelentés (7440203); Minőségi problémák bejelentése; Tartalom eltávolítása a Google-ből (DMCA). Lekérdezve: 2026. szeptember 19.


