Teknike
Sitemap-i XML
Lista e URL-ve që do të indeksohen; mjeti kontrollon ekzistencën dhe nëse XML-ja parsohet.
Çfarë është
Një sitemap XML është një listë e URL-ve që pronari i sajtit dëshiron t'i bëjë të njohura për motorët, me të dhëna shoqëruese si data e ndryshimit të fundit.
Ai nuk garanton indeksim. Motori e lexon si sugjerim dhe vendos vetë; një faqe me cilësi të dobët nuk indeksohet sepse u shtua në listë.
Vlera reale është te zbulimi: faqe të reja, faqe të thella me pak lidhje hyrëse, dhe sajte të mëdha ku ndjekja e lidhjeve merr kohë. Për një sajt me pesëdhjetë faqe të lidhura mirë, sitemap-i shton pak.
Kur URL-të kalojnë 50.000 ose skedari kalon 50 MB, duhen disa sitemap-e dhe një indeks sitemap-ësh që i lidh.
Pse ka rëndësi
Për sajte të mëdha ose me përmbajtje që ndryshon shpesh, sitemap-i e përshpejton ndjeshëm zbulimin e faqeve të reja.
Për sajte të vogla dhe mirë të lidhura, mungesa e tij nuk kushton shumë — dhe ky konstatim duhet lexuar me atë peshë.
Aty ku sitemap-i bën dëm është kur përmban URL që nuk duhen: faqe me noindex, faqe që ridrejtojnë, faqe 404, ose variante me parametra. Kjo dërgon sinjale kontradiktore dhe harxhon burime indeksimi.
Gabimi më i shpeshtë praktik është një sitemap i gjeneruar një herë dhe i harruar: ai mban URL-të e vitit të kaluar dhe nuk i ka ato të reja. Një sitemap i vjetruar është më keq se asnjë, sepse motori e beson.
Dhe një gabim teknik i zakonshëm: lastmod që përditësohet te çdo faqe në çdo ndërtim, edhe kur asgjë nuk ka ndryshuar. Pas pak, ai fillon të shpërfillet.
Si rregullohet
<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
<url>
<loc>https://shembull.com/riparim-laptopesh</loc>
<lastmod>2026-09-02</lastmod>
</url>
</urlset>Hapat:
- Gjeneroje automatikisht nga burimi i vërtetë i faqeve, kurrë me dorë.
- Vetëm URL kanonike që kthejnë 200 dhe që janë të indeksueshme.
- `lastmod` i vërtetë, që ndryshon vetëm kur ndryshon përmbajtja.
- URL absolute me të njëjtën skemë dhe host si canonical-i.
- Shto rreshtin `Sitemap:` te `robots.txt`.
- Ndaje në disa skedarë mbi 50.000 URL dhe lidhi me një indeks.
- Mos shto faqe me `noindex` — sinjalet kundërshtojnë njëri-tjetrin.
Si e mat ky mjet
SitemapAnalyzer::checkSitemap() (services/SitemapAnalyzer.php:54) përdor URL-në e gjetur te robots.txt, ose bie te <baseUrl>/sitemap.xml (:56).
Nëse marrja dështon, jep paralajmërim (:63). Nëse merr diçka, provon ta parsojë si XML (:70): kur ka elemente <url> i numëron dhe jep konstatim të kaluar (:77); kur ka <sitemap> e njeh si indeks (:75); kur XML-ja nuk parsohet, jep paralajmërim (:80).
Çfarë NUK e mat
Kontrollohen vetëm dy gjëra: se skedari kthen diçka dhe se ajo diçka është XML i parsueshëm.
Asnjë URL brenda sitemap-it nuk verifikohet. Nuk kontrollohet nëse ato kthejnë 200, nëse ridrejtojnë, nëse janë kanonike, nëse kanë noindex, apo nëse i përkasin të njëjtit domain. Një sitemap me mijëra URL të vdekura raportohet si i rregullt.
Skema e sitemap-it nuk validohet — çdo XML i parsueshëm pranohet, edhe një skedar krejt i palidhur.
Numërimi i URL-ve bëhet vetëm te niveli i parë; për një indeks sitemap-ësh, nën-sitemap-et nuk merren dhe URL-të e tyre nuk numërohen.
Marrja nuk dallon kodin e statusit, prandaj një faqe 404 me trup HTML mund të raportohet si "sitemap i pavlefshëm" në vend të "mungon".
Kodi që e kryen matjen
services/SitemapAnalyzer.php:54— SitemapAnalyzer::checkSitemapservices/SitemapAnalyzer.php:70— simplexml_load_string