Construire un graphe d'entités
de votre propre site
Les moteurs ne lisent pas votre site page par page. Ils le résolvent en choses : personnes, produits, organisations, sujets, et les liens entre eux. Moose construit ce graphe à partir des pages déjà explorées sur votre machine, et indique quels liens votre site énonce et lesquels il a déduits. Une fois le graphe construit, il peut le relire dans n'importe quel chat ultérieur.
Je m'en occupe, Sam. Cartographions comment les entités de Fathom se relient à travers le site.
Je peux créer un graphe d'entités pour ce projet. Choisissez la profondeur de l'analyse, puis lancez-la ci-dessous.
Hi, Moose cartographie les personnes, produits, lieux et sujets présents dans les pages explorées de ce projet, ainsi que leurs liens.
Chef superviseur de bureau. Se résout en une seule entité, solidement reliée au canapé et au déjeuner. Un graphe plus propre que celui de la plupart des sites.
Un moteur ne voit pas des pages. Il voit des choses, et comment elles se relient.
Avant qu'un moteur puisse vous recommander, il doit savoir ce que vous êtes. Un produit, fabriqué par une organisation, fondée par une personne, dans une catégorie, en concurrence avec ceux-là. Cette résolution a lieu que vous l'aidiez ou non.
Si votre site n'énonce jamais les connexions, le moteur les déduit de tiers ou vous laisse comme un nom flottant qu'il n'arrive pas à situer. C'est comme ça qu'on finit mentionné mais jamais recommandé, ou décrit avec la catégorie d'un concurrent.
Une carte, et deux exports
Le graphe est construit à partir des pages déjà explorées pour ce projet, donc chaque chiffre remonte à une URL qui vous appartient.
Personnes, organisations, produits, services, lieux, événements et sujets, chacun avec le nombre de pages où il apparaît, plus un décompte par type. Ce décompte suffit à dire si votre site se lit comme un produit ou comme un tas d'articles.
Un score par entité, pondéré selon l'endroit où le nom apparaît. Les données structurées comptent plus qu'un titre, et un titre compte plus qu'un sous-titre. L'entité en tête est rarement celle de la page d'accueil.
Les liens que vos pages énoncent, ceux qui reviennent sans cesse sur les mêmes pages, et ceux dont les noms sont proches par le sens. La carte répartit le total entre les trois, vous voyez donc quelle part du graphe votre site a écrite lui-même.
Les entités avec leur type, leurs alias, leur nombre de pages, leur score et jusqu'à trois URL sources chacune. Les relations avec leur sorte, leur origine et leur confiance. Le PDF est celui qu'on transfère, le CSV celui qu'on trie.
Rapide d'abord, Complet quand il le mérite
Les deux tournent sur l'exploration déjà présente sur votre machine, et les deux cartographient les liens à la fin. La différence est de savoir si un modèle lit le corps du texte.
Lit le JSON-LD de vos pages ainsi que les choses nommées dans vos titres et intertitres. Quelques secondes sur la plupart des sites, aucun modèle en jeu, rien ne quitte la machine.
Choisissez les 100, 250, 500 ou 1 000 premières pages, classées par clics Search Console si vous l'avez connecté. Un modèle lit le corps du texte et en sort les choses que vous nommez en prose sans jamais les baliser. Il tourne sur votre modèle local, votre clé OpenRouter, ou votre quota mensuel sur un forfait payant.
Les chiffres sont le constat
Vous ne lisez pas la liste. Vous lisez une poignée de chiffres, et chacun pointe vers un chantier différent.
Là où la méthode validateur-et-tableau-blanc se trompe
Vous savez comment ça se passe d'habitude : un validateur, un export d'exploration, un schéma au tableau blanc que personne ne met à jour, et un avis très arrêté sur le schema de quelqu'un qui a lu un article en 2019. C'est lent, mais la lenteur est le petit problème. Ces quatre-là expliquent pourquoi le résultat ne survit pas au contact d'un moteur.
Un validateur vérifie la syntaxe sur une page. Il ne peut pas vous dire que votre produit et votre société sont deux entités déconnectées à l'échelle du site.
Les tableurs comptent du texte. Décider que deux orthographes désignent la même organisation, et qu'une troisième en désigne une autre, demande une étape de résolution que personne ne fait à la main de façon constante.
Les graphes au tableau blanc décrivent la structure que la marque aimerait avoir. Les moteurs lisent ce qui est sur les pages, en général plus maigre et plus désordonné.
Un audit fait à la main est un coup unique, donc personne ne démontre jamais que le changement de schema a fonctionné. Ici, reconstruire prend quelques secondes, et c'est ce qui rend l'avant-après utile.
Demandez une fois, lisez la forme, publiez le correctif
Les pages sont déjà sur votre machine depuis l'exploration du site, donc le graphe est construit à partir de votre site plutôt que d'un index tiers de celui-ci.
Site Monitoring explore le projet et garde les pages en local. Le graphe tourne sur ces pages, il attend donc qu'une exploration soit terminée.
Demandez un graphe d'entités, prenez-le dans le menu Outils, ou utilisez le bouton d'un nouveau chat. Même carte dans les trois cas : choisissez Rapide ou Complet, puis lancez.
Quel type domine, quelle entité porte la pertinence, et combien de liens vos pages énoncent elles-mêmes. Emmenez le CSV ou le PDF dans le travail sur le schema, ou demandez simplement : Moose garde le graphe et peut le relire dans n'importe quel chat ultérieur.
La Rapide lit votre exploration locale, et la cartographie des liens est locale aussi, y compris la passe de similarité, qui utilise un petit modèle d'embeddings sur votre propre matériel. La Complète est celle qui envoie du texte de pages à l'extérieur, et uniquement au modèle que vous avez choisi. Prenez un modèle local et cela reste également sur la machine.
Trois sortes de liens, jamais mélangées
Un graphe qui invente discrètement des relations est pire que pas de graphe, parce que vous publieriez du balisage affirmant des choses que votre site n'a jamais dites. Chaque lien porte donc sa sorte, et la carte les compte séparément.
Fondateur, éditeur, marque, travaille pour, fait partie de. La Rapide les tire de votre JSON-LD et suit les références @id qu'il contient. La Complète ajoute celles qu'un modèle trouve énoncées dans votre prose. Si aucune page ne dit qui a fondé la société, il n'y a pas de relation de fondateur.
Des entités qui apparaissent régulièrement sur les mêmes pages, étiquetées « apparaît avec » et portant le nombre de pages qu'elles partagent. C'est la preuve d'un motif sur votre site, pas une affirmation sur le monde.
Un petit modèle d'embeddings tourne sur votre machine, compare les noms de vos entités et garde les plus fortes par entité au-dessus d'un seuil de similarité. Étiquetées « en lien avec », avec un score. C'est la couche qui donne un graphe utilisable même à un site sans aucun balisage.
La casse, la ponctuation et un Inc ou Ltd final disparaissent, donc « NinjaOne, Inc. » et « Ninjaone inc » deviennent une seule entité. Deux types différents restent deux entités, et c'est pour cela qu'une marque peut apparaître comme produit et comme organisation. Cette scission est un constat, pas un bug.
L'endroit où un nom apparaît compte autant que le nombre de fois. Les données structurées pèsent plus qu'un titre, un titre pèse plus qu'un sous-titre, et le score est compressé pour qu'une page répétant un mot n'emporte pas le classement.
Le tableau et les exports portent les 2 000 premières entités et les 2 000 premières relations, avec les totaux réels sur la carte. Si l'analyse IA est ignorée, arrêtée ou échoue, la carte le dit au lieu de faire passer un graphe Rapide pour un Complet.
Du graphe au balisage
Le graphe reste avec le projet après la carte, et Moose le lit lui-même. Vous ne lui recollez pas les chiffres. Vous lui demandez quoi en faire.
Les questions qu'on nous pose
Un graphe d'entités, en clair, c'est quoi ?
Une liste des choses dont votre site parle, et des liens entre elles. Ni mots-clés, ni pages. Un moteur en construit un sur vous que vous le regardiez ou non, donc le geste utile est de voir le vôtre et de décider s'il dit ce que vous vouliez dire.
Pourquoi la plupart de mes relations sont-elles par pages partagées ou sémantiques ?
Parce que ce sont les deux que Moose peut déduire seul. Les étiquetées viennent de votre balisage, plus ce que l'analyse Complète lit dans votre prose, et sur la plupart des sites le balisage s'arrête au template d'article. Le nombre d'étiquetées démarre donc bas. Le faire monter, c'est tout l'intérêt.
Ai-je besoin de balisage schema pour que ça marche ?
Non. Sans lui vous obtenez quand même des entités depuis vos titres et intertitres, et des liens depuis les pages partagées et la similarité des noms. Ce que vous n'aurez pas, c'est une seule relation étiquetée, et c'est déjà le constat.
Combien coûte l'analyse Complète ?
Rien de plus que du temps sur un modèle local. Sur un modèle en ligne, elle dépense votre clé OpenRouter, ou votre quota mensuel si vous êtes sur un forfait payant. Vous choisissez le nombre de pages lues : 100, 250, 500 ou 1 000. La Rapide n'a besoin d'aucun modèle et est gratuite sur tous les forfaits.
Que faut-il avant de pouvoir en construire un ?
Un projet avec un site web, et une exploration du site terminée. Le graphe lit des pages déjà stockées sur votre machine, donc si aucune exploration n'a tourné, la carte vous envoie d'abord vers Site Monitoring.
Moose peut-il se servir du graphe une fois construit ?
Oui. Le graphe reste avec le projet, et Moose peut le relire dans n'importe quel chat ultérieur. Demandez-lui quels liens internes ajouter, comment organiser le site ou quel trou de schema combler en premier : il tire la réponse du graphe, pas de sa mémoire. Il garde ce que vos pages énoncent séparé de ce qu'il a déduit, donc il ne vous dira pas de corriger un balisage qui n'a jamais existé. Et si le projet n'a pas encore de graphe, il propose d'en construire un.
En quoi est-ce différent d'un contrôle de couverture ?
La couverture répond à la question de savoir si vous avez écrit sur un sujet. Le graphe répond à ce que votre site dit que vous êtes. Il faut les deux : l'un vous évite d'écrire des doublons, l'autre évite que les moteurs vous décrivent dans une catégorie où vous ne vendez pas.
D'autres choses à demander à Moose
Tous les cas d'usageDemandez avant de commander, et obtenez les pages, le verdict et ce qui manque.
Demandez pourquoi le trafic a bougé et obtenez une réponse avec les tableaux dessous.
Les recherches que Google écrit pour lui-même avant de répondre, et qui il cite.
Douze recherches derrière un prompt, dont celles qui nomment les marques auxquelles il se fie.
Une question, cinq moteurs réels, environ une minute. Gratuit sur tous les forfaits.
La liste complète, et ce que Moose fait étape par étape dans chacun.
Voyez la version de vous
qu'un moteur peut lire.
Téléchargez Hi, Moose, explorez votre site une fois, et construisez le graphe en quelques secondes. La Rapide tourne sur le forfait gratuit.