Les suggestions de recherche sont les variantes de requêtes que Yandex affiche directement dans la barre de recherche pendant que l'utilisateur tape son texte. Pour le SEO, c'est l'une des sources de mots-clés les plus précieuses : les suggestions sont issues de requêtes réelles des internautes, se mettent à jour presque quotidiennement et reflètent parfaitement les formulations « vivantes » dans pratiquement toutes les thématiques. Le scraping des suggestions est une étape incontournable de la constitution d'un corpus de mots-clés complet.
Cet article fait partie de notre série sur le web scraping appliqué au SEO. Nous y détaillons le fonctionnement de la collecte des suggestions de recherche, les réglages importants et les outils à utiliser.
Pourquoi les suggestions sont une source à part, et non un équivalent de Wordstat
Beaucoup pensent que Yandex Wordstat couvre l'ensemble de la demande. Ce n'est pas le cas. Wordstat affiche des statistiques d'impressions, mais la base des suggestions existe indépendamment de la base des requêtes clés et contient souvent des formulations absentes de Wordstat ou difficiles à en « extraire ». Les suggestions captent bien les requêtes de longue traîne, les tournures familières et les tendances récentes. C'est pourquoi, dans une collecte de mots-clés complète, suggestions et Wordstat se complètent au lieu de se remplacer.
Nuance importante : parmi les suggestions se glissent des phrases générées automatiquement que presque personne n'utilise. Après la collecte, il faut donc impérativement vérifier la fréquence des suggestions, faute de quoi le corpus sera pollué par des « coquilles vides ».
Comment fonctionne la collecte des suggestions
La logique est similaire pour tous les scrapers. Vous chargez une liste de phrases de base, et le scraper leur ajoute des caractères puis collecte les variantes qui apparaissent dans la liste déroulante. Paramètres clés :
Itération sur les caractères. On ajoute à la phrase de base une espace, puis tour à tour des lettres et des chiffres : [а-я], [a-z], [0-9]. Chaque caractère ouvre un nouveau jeu de suggestions. Plus l'itération est large, plus le résultat est complet — mais plus il y a de bruit.
Profondeur de scraping. À la profondeur 1, seules les suggestions des phrases initiales sont collectées. À la profondeur 2, les phrases trouvées à la première étape sont réinjectées en entrée et de nouvelles suggestions sont collectées à partir d'elles. La profondeur 3 offre la couverture maximale : des requêtes à fort et moyen volume, et une quantité énorme de requêtes de longue traîne. Pour la plupart des projets, une profondeur de 1 à 2 suffit ; on passe à 3 lorsqu'une couverture exhaustive de la niche est nécessaire.
Région. Les suggestions sont régionalisées : la région de collecte se définit selon le projet (par défaut, généralement Moscou, code 213).
Mots d'exclusion. Une liste de mots qui interrompent la collecte. Si le scraper rencontre une suggestion contenant un mot d'exclusion, il n'explore pas cette branche « en profondeur ». Cela économise le budget et écarte d'emblée les phrases non pertinentes.
Avec quoi scraper les suggestions : panorama des outils
Rush Analytics — sans doute le service en ligne le plus pratique pour les suggestions. Il collecte les suggestions de Yandex, Google et YouTube dans un même projet, prend en charge une itération flexible [а-я], [a-z], [0-9] et une profondeur jusqu'à 3, n'importe quelle région, les mots d'exclusion et la vérification de fréquence des phrases collectées. Une API est disponible. Idéal pour une collecte volumineuse et propre sans se soucier des proxys.
Key Collector 4 — un logiciel de bureau où la collecte des suggestions se trouve dans l’onglet « Parsing » (nom de l’onglet dans l’interface du logiciel). Son avantage : les suggestions arrivent directement dans le projet global de mots-clés, à côté des données Wordstat, où l'on peut les filtrer et les regrouper. Inconvénient : il faut ses propres comptes, proxys et service anti-captcha.
A-Parser — un scraper universel qui collecte les suggestions de plusieurs moteurs à la fois (Yandex, Google, Bing, Yahoo, AOL) et de YouTube, avec réglage de la langue, du pays et du domaine. Excellent pour les très grandes bases et l'automatisation sur mesure, mais il exige une configuration technique.
Arsenkin Tools — une boîte à outils en ligne avec un scraper de suggestions couvrant deux moteurs de recherche et une plateforme vidéo. Une offre gratuite avec limites quotidiennes est disponible, pratique pour les besoins ponctuels.
JustMagic — un service d'automatisation SEO où les suggestions servent notamment à sélectionner des phrases LSI. Il propose des modes de collecte simple, de validation des requêtes et un mode de débogage itératif, avec itération sur l'alphabet russe, l'alphabet latin et les chiffres.
Click.ru et Serpstat savent également collecter les suggestions — pratique si vous utilisez déjà ces services pour d'autres tâches.
À quoi serviront ensuite les suggestions de recherche
Les suggestions collectées sont une « matière première ». Il faut ensuite les nettoyer, vérifier leur fréquence via Wordstat et les fusionner avec les autres sources dans le cadre d'une collecte de mots-clés complète. Une partie des phrases issues des suggestions servira de base à de nouvelles rubriques du site — et influencera donc la structure du site ainsi que les balises et titres que vous rédigerez sur les pages.
Si vous devez analyser non seulement les suggestions, mais aussi les résultats de recherche eux-mêmes pour ces requêtes — qui occupe le top et comment sont construits les snippets — c'est déjà le domaine de l'extraction de SERP Yandex, que nous proposons comme service à part entière.