Search Console Indexation de milliers de pages d'un site de dizaines de pages

Discussion dans 'Crawl et indexation Google, sitemaps' créé par elg.digital, 26 Juillet 2019.

  1. elg.digital
    elg.digital Nouveau WRInaute
    Inscrit:
    19 Février 2013
    Messages:
    2
    J'aime reçus:
    0
    Bonjour tout le monde,

    Je travaille sur un site d'hôtel au Maroc. Dernièrement, j'ai remarqué une hausse très importante de nombre des pages explorées sur le Search Console (près de 90 000 pages) mais le site n'a qu'une dizaines de pages.
    Ces pages sont en .pdf et il redirige vers d'autres sites.
    quand je fait un vérification du sitemap.xml, il ne contient aucune de ces pages.

    Est-ce que quelqu'un a eu ce problème avant? je vous prie de me donner votre avis sur ce problème.

    En vous remerciant.
     
  2. colonies
    colonies WRInaute impliqué
    Inscrit:
    10 Septembre 2006
    Messages:
    677
    J'aime reçus:
    111
    Les sitemaps ne sont qu'une indication donnée à Google de ce que tu veux être exploré, mais Google ne se restreint pas à ces URL.
    As-tu ouvert l'un de ces PDF pour voir ce qu'il contient ? Car Google suit aussi les liens vers les PDF, et si ces PDF sont générés automatiquement, Google peut boucler à l'infini.
    Par exemple, il trouve un lien vers 1.pdf.
    Ce fichier 1.pdf contient un lien vers un site externe, et un lien vers 2.pdf.
    Google consultera 2.pdf, qui contient un lien vers un site externe, et un site vers 3.pdf
    etc.

    Si ce sont des liens vers des sites externes, je pencherais pour un script malicieux qu'il faudra que tu trouves et élimine.
    Pour commencer, si les extensions des fichiers sont en .pdf et qu'il n'y a pas de fichier .pdf correspondant sur ton serveur, cherche dans un fichier .htaccess ou dans la configuration de ton serveur : tu devrais y trouver l'emplacement du script qui génère les fichiers pdf.
     
  3. freestyle83
    freestyle83 WRInaute occasionnel
    Inscrit:
    19 Novembre 2011
    Messages:
    389
    J'aime reçus:
    16
    Tu peux aussi regarder tes logs apaches pour voir ce que le bots a fait. (disponible sur ton herbergement normalement)
     
  4. WebRankInfo
    WebRankInfo Admin
    Membre du personnel
    Inscrit:
    19 Avril 2002
    Messages:
    20 822
    J'aime reçus:
    829
  5. elg.digital
    elg.digital Nouveau WRInaute
    Inscrit:
    19 Février 2013
    Messages:
    2
    J'aime reçus:
    0
    Merci beaucoup pour ces informations,
    J'essaie de suivre vos conseils pour voir ce que ça donne par la suite.
     
Chargement...
Similar Threads - Indexation milliers dizaines Forum Date
Indexation puis desindexation de milliers de pages Référencement Google 16 Avril 2013
Pénalités Indexation milliers de page d'un coup ? Crawl et indexation Google, sitemaps 30 Novembre 2007
indexation de milliers de pages Crawl et indexation Google, sitemaps 18 Novembre 2004
WordPress Site multilingues - Mauvaise indexation Crawl et indexation Google, sitemaps Mardi à 09:47
Problème de crawl et d'indexation Crawl et indexation Google, sitemaps 1 Septembre 2022
Indexation page de paiement ? Crawl et indexation Google, sitemaps 17 Août 2022
Problème d'indexation de backlinks Débuter en référencement 24 Juillet 2022
Problème d'indexation de backlinks Problèmes de référencement spécifiques à vos sites 21 Juillet 2022
Désindexation images en changeant de format (passage à WebP) Crawl et indexation Google, sitemaps 12 Juillet 2022
6 mois après, pas d'indexation correcte dans Google Problèmes de référencement spécifiques à vos sites 8 Juillet 2022
Problème désindexation des pages de Google Débuter en référencement 21 Juin 2022
Indexation à rebours. Crawl et indexation Google, sitemaps 5 Juin 2022
Problème d'indexation de pages sur Google Problèmes de référencement spécifiques à vos sites 31 Mai 2022
référencement site en anglais : indexation plus longue Référencement international (langues, pays) 13 Mai 2022
Problème d'indexation Produits Prestashop Crawl et indexation Google, sitemaps 28 Avril 2022
Problème indexation pages précises en React.js Débuter en référencement 19 Avril 2022
Pourquoi ne pas utiliser le robots.txt pour interdire l'indexation ? Débuter en référencement 14 Avril 2022
Conseil pour accélérer l'indexation de mon nouveau site Problèmes de référencement spécifiques à vos sites 9 Avril 2022
Comment puis-je obtenir l'indexation instantanée de Google ? Débuter en référencement 28 Mars 2022
Questions URL canonique, crawl et indexation Débuter en référencement 25 Mars 2022