À propos des pages web en cache
Qu’est-ce qu’une page web mise en cache ?
Une page mise en cache est une copie d’une page telle qu’elle apparaissait à un moment antérieur, conservée par quelqu’un d’autre que son propriétaire. Elle vous permet de lire une page qui a été modifiée, déplacée ou a complètement disparu.
Cet outil utilise la Wayback Machine, l’archive publique du Web gérée par Internet Archive, qui capture des pages depuis 1996. Saisissez une adresse et la copie la plus récente qu’elle contient s’ouvrira dans un nouvel onglet.
Nous ne stockons ni n’envoyons quoi que ce soit : l’outil construit simplement l’adresse de l’archive et vous y redirige.
Qu’est-il arrivé au cache de Google ?
Pendant vingt ans, la façon habituelle d’afficher une page mise en cache consistait à utiliser la propre copie de Google, accessible avec une recherche utilisant l’opérateur cache: ou via un lien dans les résultats. Google a supprimé cette fonctionnalité en 2024, et l’opérateur cache: ne fonctionne plus.
La Wayback Machine est désormais le remplacement le plus pratique et, à bien des égards, une meilleure solution. Elle conserve plusieurs copies d’une page au fil du temps, plutôt que seulement la plus récente, ce qui permet de voir comment une page a évolué au lieu de voir uniquement ce qu’elle indique aujourd’hui.
Le compromis concerne la couverture. Google mettait plus ou moins en cache tout ce qu’il indexait ; les archives conservent un échantillon large, mais incomplet, et les sites petits ou récents sont souvent absents.
À quoi servent les pages mises en cache
- Lire une page qui est indisponible, qui a été déplacée ou supprimée.
- Voir ce qu’une page disait avant sa réécriture.
- Récupérer du contenu rédactionnel d’un site que vous ne contrôlez plus.
- Vérifier ce qu’un concurrent a modifié, et approximativement quand.
- Confirmer une affirmation concernant ce qu’une page disait auparavant.
- Retrouver l’ancienne structure des URL d’un site après une migration.
La dernière est discrètement la plus utile pour le référencement naturel. Une migration dont les redirections ont disparu est beaucoup plus facile à réparer lorsque vous pouvez voir à quoi ressemblaient les URL auparavant.
Lire attentivement une page archivée
Une page archivée est une reconstitution plutôt qu’une photographie. Le code HTML est capturé fidèlement, mais les feuilles de style, les polices, les images et les scripts sont récupérés séparément et peuvent être manquants ou provenir d’une autre date. Une page peut donc sembler s’afficher incorrectement alors que son texte est parfaitement exact.
Tout ce qui dépendait d’un serveur en ligne ne fonctionnera pas. Les champs de recherche, les connexions, les paniers et la plupart des fonctionnalités interactives sont inactifs, et le contenu chargé par JavaScript après le rendu de la page est souvent totalement absent.
Vérifiez la date dans la barre d’outils des archives avant de tirer des conclusions. La capture la plus proche d’aujourd’hui peut dater de la semaine dernière ou d’il y a quatre ans, et rien sur la page elle-même ne vous indique laquelle.
Quelle adresse saisir
Toute forme raisonnable de l’adresse convient. L’archive normalise l’adresse fournie : example.com, www.example.com, http://example.com et https://example.com renvoient tous au même enregistrement — il n’est pas nécessaire de deviner quelle version a été archivée.
Saisissez le chemin complet pour rechercher une page plutôt que le site. Une page spécifique constitue un enregistrement différent de la page d’accueil, et la page d’accueil ne vous indiquera pas ce que disait un article.
Si aucun contenu n’est archivé pour cette adresse, l’archive renvoie une page introuvable plutôt qu’une suggestion. Cela signifie généralement que la page n’a jamais été capturée, ce qui est fréquent pour les petits sites et pour tout contenu récent.
Ce que fait cet outil
Il vérifie que l’adresse est plausible, crée l’URL de l’archive correspondant à la capture la plus récente et l’ouvre dans un nouvel onglet. Il n’effectue aucune recherche et rien ne doit être chargé.
Comme l’archive résout elle-même l’adresse, l’outil ne réécrit volontairement pas ce que vous saisissez, hormis pour l’encoder. Deviner un protocole ou ajouter « www » risquerait de demander un enregistrement différent de celui que vous aviez en tête.
Pour aller plus loin
Une page mise en cache vous indique ce qui s’y trouvait ; ces outils vous renseignent sur ce qui s’y trouve actuellement. Vérifiez où mène une URL aujourd’hui avec le
vérificateur de redirections, si elle est accessible ou non avec le vérificateur de
Code d’état de l’URL, et comment la page actuelle est structurée grâce à un
audit de site complet.