S'inscrire à la newsletter
Extraits optimisésBrevetsTitres

Passages-réponses et titres SEO : comment Google utilise la hiérarchie de vos titres pour choisir une réponse mise en avant

Par 11 min de lecture

Un score de contexte pour un passage-réponse est un ajustement du score d'un passage selon sa place dans la page : les titres qui le surplombent, la question qu'ils posent, et la forme du texte qui l'entoure. Le brevet US 9,959,315 B1, « Context scoring adjustments for answer passages », le décrit. Google l'a déposé le 31 janvier 2014, et le brevet a été délivré le 1er mai 2018.

Que décrit le brevet US 9,959,315 ?

Le brevet US 9,959,315 décrit un procédé de notation par le contexte qui note à nouveau les passages candidats à la réponse d'une requête-question, à partir de la structure des pages d'où ils viennent. Ses 4 inventeurs sont Nitin Gupta, Srinivasan Venkatachary, Lingkun Chu et Steven D. Baker. Le brevet compte 20 revendications et 7 planches de dessins.

Le brevet présente ces signaux de contexte comme en partie « indépendants de la requête », notés « indépendamment de leur lien avec les termes de la requête ». Ils captent des signaux de pertinence que la notation dépendante de la requête peut manquer, afin que « les réponses longues les plus susceptibles de satisfaire le besoin d'information de l'utilisateur aient plus de chances d'apparaître ».

Le brevet vise les questions qui demandent une explication. Il les appelle des « réponses longues » ou « passages-réponses », par opposition aux faits courts donnés dans une « one box », et donne l'exemple [why is the sky blue], où « une réponse qui explique la diffusion de Rayleigh est utile ». Le brevet n'emploie pas le terme « extrait optimisé », mais il décrit l'encadré de réponse avec un passage affiché au-dessus des résultats.

Comment Google choisit-il les passages candidats ?

Google choisit les passages candidats dans des sections de texte d'une ou plusieurs ressources, puis attribue à chacun un score de réponse. Un module de traitement des questions décide d'abord si la requête est une question, précise comme [How far away is the moon] ou implicite comme [distance of the earth from the moon], à l'aide de modèles de langage, d'apprentissage automatique, de graphes de connaissances, de grammaires ou d'une combinaison de ces outils. Chaque candidat est une ou plusieurs phrases, ou un texte limité à un nombre maximal de caractères, tiré de la section placée sous un titre. Plusieurs candidats peuvent venir de la même section.

Le score de réponse initial peut reposer sur 3 critères : « la correspondance d'un terme de la requête avec le texte du passage candidat, la correspondance de termes de réponse avec ce texte, et la qualité de la ressource dont le passage est tiré ». Le score de contexte ajuste ensuite ce score de réponse : « un processus additif, un processus multiplicatif, etc. ». Le score de contexte peut être un score unique qui met à l'échelle le score de réponse, ou une série de bonus distincts. Quand plusieurs bonus s'appliquent, le système peut garder le plus élevé ou les combiner, puis il retient le passage dont le score ajusté est le plus haut.

Qu'est-ce qu'un vecteur de titres ?

Un vecteur de titres est le chemin des titres depuis la racine de la page jusqu'au titre sous lequel se trouve le passage. Le titre racine est, par exemple, le titre de la page. Les titres sont détectés à partir des balises de titre du DOM, ou du texte d'ancre de liens internes qui renvoient à une section. Une section de texte est « subordonnée » à un titre quand elle en descend directement, même si elle ne lui est pas adjacente.

La page d'exemple du brevet sur la Lune donne cette hiérarchie :

  • Racine : About The Moon
  • H1 : The Moon's Orbit
  • H2 : How long does it take for the Moon to orbit Earth?
  • H2 : The distance from the Earth to the Moon
  • H1 : The Moon
  • H2 : Age of the Moon
  • H2 : Life on the Moon

Un passage placé sous « The distance from the Earth to the Moon » a pour vecteur <About The Moon, The Moon's Orbit, The distance from the Earth to the Moon>.

Comment la profondeur des titres modifie-t-elle le score ?

La profondeur des titres modifie le score parce que les passages profonds reçoivent un bonus plus élevé que les passages superficiels. La profondeur compte les titres parents au-dessus du titre du passage, jusqu'à la racine : un passage sous un H2 a une profondeur de 2 (son H1 et la racine), ou de 3 si l'on compte aussi le H2. Avec un seuil d'exemple de 2, un passage de profondeur 1 est « superficiel » et un passage de profondeur 2 ou plus est « profond ».

Le brevet donne des valeurs d'exemple : un premier facteur de 1,0 ou moins pour les passages superficiels, et un second facteur « supérieur à 1,0 » pour les passages profonds. Dans une autre version, chaque niveau supplémentaire ajoute son propre ajustement : « plus la profondeur est grande, plus l'augmentation est forte ». Les revendications 2 et 3 protègent cette notation par la profondeur.

Comment les titres qui correspondent à la question modifient-ils le score ?

Les titres qui correspondent à la question reçoivent des facteurs de bonus de correspondance, du plus fort au plus faible, sur 3 niveaux :

  1. Correspondance du dernier titre : le score du titre juste au-dessus du passage, pris seul, est le plus élevé des scores. Pour [How far away is the moon], « The Distance from the Earth to the Moon » obtient le premier bonus, le plus élevé, qui peut être fixe ou proportionnel à la similarité.
  2. Correspondance de l'avant-dernier niveau : le titre et son parent, lus ensemble, correspondent à la question. L'exemple du brevet : la requête [How to get speeding ticket dismissed in South Carolina] correspond à la paire « Traffic Ticket FAQ in South Carolina » et « How can I get my traffic ticket dismissed? ». Elle obtient un second bonus, plus faible.
  3. Correspondance de tous les titres : les titres de tout le chemin correspondent à la question au-dessus d'un seuil minimal, signe que « la page dans son ensemble peut viser à répondre ». Elle obtient le troisième bonus, le plus faible.

Si aucune de ces conditions n'est remplie, le passage ne reçoit aucun bonus de correspondance.

Une version plus simple calcule un seul score de similarité entre la question et le texte des titres, à partir du titre le plus proche ou de plusieurs titres mis bout à bout, et ajuste le score de réponse par ce score, éventuellement seulement au-dessus d'un seuil de similarité. Le texte du passage lui-même peut aussi être comparé aux titres. La similarité peut reposer sur « la correspondance de termes, de synonymes, etc. ». Dans l'exemple de la Lune, les vecteurs qui contiennent un titre sur la distance l'emportent sur le vecteur consacré à la durée de l'orbite, « grâce au terme far ».

Qu'est-ce que le taux de couverture d'un passage ?

Le taux de couverture d'un passage est la part de son bloc de texte qu'un passage candidat couvre, mesurée en caractères, en mots ou en phrases. Un taux faible « peut indiquer que le passage candidat est incomplet », tandis qu'un taux élevé indique que le passage « reprend une plus grande partie du texte dont il est tiré ».

Le bloc de texte peut être la section d'où vient le passage, ou un bloc plus large qui ajoute les sections sœurs partageant le même titre parent. Le brevet donne des seuils d'exemple de 0,3, 0,35 ou 0,4. Sous le seuil, le passage reçoit un premier facteur, éventuellement neutre à 1,0 ; au niveau du seuil ou au-dessus, un second facteur comme 1,1. Dans l'exemple de la Lune, le passage 1 a le taux le plus élevé, le passage 2 le deuxième et le passage 3 le plus faible, et les 3 atteignent le seuil. Sur ce critère, une section courte que le passage couvre presque entièrement l'emporte sur une longue section dont le passage ne reprend qu'un fragment.

Quels autres éléments rapportent un bonus ?

3 autres éléments rapportent un bonus, selon le brevet :

  1. Le texte distinctif : un texte mis en forme pour se distinguer, par exemple un texte en gras dans la section qui n'est ni un titre ni une partie du passage, rejoint le vecteur de titres et ajoute un niveau de profondeur, ce qui « peut entraîner un léger bonus » selon le mode de notation.
  2. Une question qui précède : une question placée dans le texte avant le passage rapporte un bonus « inversement proportionnel à la distance dans le texte », et la recherche s'arrête à la première question trouvée. Le bonus peut aussi dépendre du fait que la question soit un titre et que le passage se trouve sous ce titre. Quand une question est le texte d'ancre d'une liste de navigation, elle ne précède que la section vers laquelle elle pointe. Dans la page sur la Lune, le passage qui suit directement « Why is the distance changing? » (passage 3) obtient le bonus de question le plus élevé, le passage 1, juste après « How long does it take for the Moon to orbit Earth? », le deuxième, et le passage 2, qui contient lui-même la question, le plus faible.
  3. Une liste : une liste signale des étapes, utiles pour les requêtes « à étapes » comme [How to install a door knob] ou [How do I change a tire] ; la détection des listes peut être réservée à ces requêtes. Les listes sont détectées par les balises HTML, les microformats, le sens sémantique ou des titres consécutifs de même niveau aux formulations proches, comme « Step 1, Step 2 » ou « First; Second; Third ».

Le brevet note la qualité d'une liste. Une liste « au centre d'une page » avec peu de liens vers d'autres pages l'emporte sur une liste « sur le côté d'une page » composée surtout de liens, qui ressemble à une liste de références. Le bonus de liste peut être fixe ou proportionnel à ce score de qualité. Il peut aussi augmenter quand les autres éléments obtiennent des scores élevés, car leur combinaison « est un signal fort d'une réponse de grande qualité ».

Le score de contexte change-t-il le gagnant ?

Oui : le score de contexte peut inverser l'ordre initial. Dans l'exemple du brevet, 3 candidats viennent de la page sur la Lune. Le passage 2, qui commence par « Why is the distance changing? », a le score initial le plus élevé, suivi du passage 3, puis du passage 1. Après les ajustements de contexte, le passage 3, le même texte sans la phrase de question, passe en tête et devient la réponse, suivi du passage 2, puis du passage 1.

La notation des passages eux-mêmes, avec les termes de la requête et les termes de réponse attendus, fait l'objet d'un brevet compagnon sur la notation des passages-réponses, signé lui aussi par Steven D. Baker et Srinivasan Venkatachary.

Que change le brevet sur le score de contexte pour votre SEO ?

Le brevet signifie que la structure d'une page décide du passage que Google peut extraire comme réponse. 6 conséquences en découlent :

  1. Rédigez des titres qui posent ou énoncent la question. Le titre juste au-dessus de la réponse obtient le bonus de correspondance le plus élevé quand il est le plus proche de la requête.
  2. Imbriquez des sous-titres précis sous des titres plus larges. Les passages profonds sous des sous-titres précis l'emportent sur les passages superficiels, et un titre et son parent peuvent ensemble correspondre à une longue requête.
  3. Gardez des sections de réponse courtes et complètes. Le taux de couverture récompense un passage qui couvre l'essentiel de sa section : placez la réponse dans une section courte plutôt que de l'enfouir dans une longue.
  4. Placez la question juste avant la réponse, pas dedans. Une question qui précède renforce le passage qui la suit, d'autant plus que la distance est courte ; dans l'exemple du brevet, le passage qui commence après la question l'emporte sur celui qui l'inclut.
  5. Utilisez de vraies listes pour les étapes. Pour les requêtes « comment faire », une liste dans le contenu principal, avec peu de liens, obtient un bonus de liste.
  6. Mettez en gras les termes clés de la section. Le texte distinctif ajoute un niveau au vecteur de titres, ce qui peut apporter un léger bonus.

Lors d'une optimisation on-page, nous reconstruisons la hiérarchie des titres pour que chaque titre-question surmonte directement une section courte qui y répond.

La même logique de passages autonomes aide les résumés génératifs à vérifier et à citer une page.

Le brevet décrit ce que le système de Google peut faire. Il ne confirme pas que les extraits optimisés utilisent aujourd'hui ces bonus exacts.

Quiz express

Avez-vous tout compris ?

Testez ce que vous venez de lire.

Question 1 sur 4

Qu'est-ce qu'un vecteur de titres ?

Articles liés

Nous lisons les brevets pour que vous n'ayez pas à le faire.

Chaque semaine : 3 enseignements SEO étayés par les données, 1 mythe démonté, 1 méthode à reprendre. Sans remplissage. Sans conseils de gourou.

Gratuit pour toujours. Désinscription à tout moment. Nous respectons votre boîte mail. Confidentialité.