Outil gratuit

Votre site vu par un robot

Pas de couleurs, pas de mise en page, pas d'animation : les moteurs de recherche et les outils d'IA lisent surtout le texte brut de votre page, dans l'ordre du code. Le voici, avec ce que les robots ne voient pas.

Nous lisons la page et son robots.txt une seule fois, sans rien conserver.

Essayer avec physalisdesign.com, wikipedia.org

Pourquoi le texte brut compte

Vos visiteurs voient une mise en page ; les robots lisent un document. Google, Bing, ChatGPT, Claude ou Perplexity comprennent votre page par son texte, ses titres, ses liens et le texte alternatif de ses images. Ce qui paraît évident à l'écran (un prix dans une image, un numéro de téléphone dans une bannière, un menu construit par JavaScript) peut tout simplement ne pas exister pour eux.

01

Du texte dans le HTML

Le serveur doit envoyer le texte lui-même, pas seulement un script qui le construira plus tard. C'est le cas avec WordPress, Drupal et la plupart des sites classiques.

02

Des titres qui racontent

Lisez seulement les lignes qui commencent par # : résument-elles la page ? C'est à peu près ce qu'un robot retient d'abord.

03

Des mots dans les images

Le texte d'une image est invisible, sauf si le texte alternatif le reprend. Écrivez les informations importantes en vrai texte.

Robots d'IA : les bloquer ou non ?

Il n'y a pas de réponse universelle. Bloquer les robots d'entraînement (GPTBot, ClaudeBot, Google-Extended, CCBot) tient vos textes à l'écart des futurs modèles ; bloquer les robots de recherche (OAI-SearchBot, Claude-SearchBot, PerplexityBot) vous retire aussi des réponses de ces outils, liens compris. Beaucoup d'organismes permettent la recherche et bloquent l'entraînement. Cela se règle dans robots.txt, avec un groupe User-agent par robot.