Extracteur d'URLs
Indiquez une URL : le serveur récupère la page et liste tous les liens trouvés avec leur texte, en distinguant les liens internes (même domaine) des liens externes.
Regarder une page ne suffit pas à savoir vers quoi elle pointe : une bonne partie des liens se cache dans les menus déroulants, les blocs de recommandation et le pied de page. Cet outil récupère la page côté serveur et liste tous ses liens http et https avec leur texte d’ancre, séparés en internes et externes. Il sert aux audits de maillage, aux analyses concurrentielles et aux vérifications avant mise en ligne.
Comment les liens sont extraits et classés
Le serveur télécharge la page en revalidant chaque redirection, puis parcourt toutes les balises d’ancre du HTML. Pour chacune, il récupère l’attribut href et le texte visible, débarrassé de ses balises internes : l’ancre d’une image sans texte alternatif retombe donc sur l’URL elle-même. Le texte est tronqué à 200 caractères pour rester lisible dans le tableau.
Chaque href est ensuite résolu par rapport à l’URL finale de la page, ce qui transforme les liens relatifs comme ../contact en URL absolues. Les ancres internes commençant par #, ainsi que les liens mailto:, tel: et javascript:, sont écartés : ce ne sont pas des liens vers des pages. Les doublons sont supprimés après normalisation, si bien que le même lien répété dans le menu et dans le pied de page n’apparaît qu’une fois.
Le classement interne/externe se fait sur une comparaison stricte de nom d’hôte avec la page analysée. Conséquence à connaître : un sous-domaine est compté comme externe, blog.exemple.fr est externe pour une page servie depuis www.exemple.fr, ce qui correspond d’ailleurs à la façon dont les moteurs traitent les sous-domaines. Chaque liste est plafonnée à 300 entrées, avec un avertissement affiché si la page en contient davantage.
Ce que la liste de liens vous apprend
Les liens internes distribuent l’autorité entre vos pages et indiquent aux moteurs quelles pages comptent. Une page importante qui ne reçoit aucun lien depuis le reste du site est mal placée, quelle que soit sa qualité. À l’inverse, une page qui émet des centaines de liens répartit très peu de valeur sur chacun. Le texte d’ancre est tout aussi informatif : une liste où « cliquez ici » et « en savoir plus » dominent signale un maillage qui n’aide ni les moteurs ni les lecteurs.
Les liens sortants racontent une autre histoire. Ils montrent sur quelles sources s’appuie une page : un signal que les moteurs de réponse comme Perplexity ou ChatGPT prennent en compte quand ils évaluent la fiabilité d’un contenu. Sur une page concurrente, la liste des liens externes révèle son écosystème de références ; sur la vôtre, elle permet de repérer les liens vers des sites disparus, qui restent une gêne pour le lecteur.
Cas d’usage concrets
Audit de maillage interne
Vérifier depuis quelles pages part le maillage d’une catégorie, et repérer les ancres génériques qui n’apportent aucun contexte aux moteurs.
Analyse concurrentielle
Voir vers quelles ressources externes pointe une page bien positionnée, et quelles pages internes elle met en avant dans son propre site.
Contrôle avant mise en ligne
S’assurer qu’une nouvelle page ne contient plus d’URL de préproduction ni de lien laissé en placeholder avant publication.
Ce que cet outil ne fait pas
L’outil analyse une seule page : ce n’est pas un crawler, il ne suit pas les liens trouvés. Il ne teste pas non plus leur code de réponse, donc il ne détecte pas les liens morts. Il n’exécute pas le JavaScript, si bien qu’un menu construit côté client restera invisible, et il ignore l’attribut rel : les liens nofollow ou sponsored ne sont pas distingués des autres.
Pour aller plus loin
- Maillage interne automatisé : passer d’une inspection page par page à une stratégie de liens à l’échelle du site.
- Vérificateur de Sitemap XML : confronter les URL réellement liées à celles déclarées dans votre sitemap.
Questions fréquentes
Comment l'outil distingue-t-il liens internes et externes ?+
Un lien est considéré comme interne si son nom de domaine correspond exactement à celui de la page analysée (après résolution des liens relatifs), externe sinon.
Les liens mailto: ou tel: apparaissent-ils dans la liste ?+
Non, ils sont filtrés car ce ne sont pas des liens vers d'autres pages web. Seuls les liens http et https sont conservés.
L'outil suit-il les liens pour analyser les pages suivantes ?+
Non, il analyse uniquement la page dont vous fournissez l'URL. Ce n'est pas un crawler qui explore tout un site.
Pourquoi un lien vers mon sous-domaine est-il classé comme externe ?+
Parce que la comparaison porte sur le nom d'hôte complet : blog.exemple.fr et www.exemple.fr sont deux hôtes différents. Cette distinction rejoint le traitement des moteurs de recherche, qui considèrent largement un sous-domaine comme un site distinct.
Les liens en nofollow sont-ils signalés ?+
Non. L'outil extrait l'URL et le texte d'ancre, sans lire l'attribut rel. Pour distinguer nofollow, sponsored ou ugc, il faut inspecter le code source de la page ou utiliser un crawler complet.
Cette liste de liens suffit-elle à auditer mon maillage interne ?+
Non. Elle donne la photographie d'une page, pas la vue d'ensemble : elle ne dit rien de la profondeur de clic depuis l'accueil, du nombre de liens reçus par chaque page, ni des pages orphelines. Ce sont des questions à l'échelle du site, qui demandent un crawl complet.
Envie d’automatiser tout votre SEO ?
GetRerank prolonge ces outils gratuits avec un plan de contenu, la rédaction et la publication automatiques, mesurés sur Google et six moteurs IA.
Découvrir GetRerank