# robots.txt — hoodi.ai # # Le site n'a rien à cacher aux robots : tout ce qui ne doit pas être indexé # porte sa PROPRE balise `` — les 9 pages # hors sitemap (la 404, /ds, les 3 pages du funnel Google Ads, les 3 pages de # remerciement, et /telechargement-modele-carnet-entretien depuis le lot 6.3 : # le modèle Excel est livré par courriel APRÈS inscription, et l'indexer # offrirait le fichier sans le formulaire). Une balise `noindex` est plus # fiable qu'un `Disallow` : un # `Disallow` empêche la lecture, donc empêche aussi le robot de VOIR le # `noindex`, et l'URL peut rester indexée sans son contenu. # # ⚠ CE BLOC DISAIT L'INVERSE JUSQU'AU 2026-08-10, et il est relu à la main ce # jour-là (dette D-023, dont la destination était « le jour J »). Énoncé # d'époque, vrai jusqu'à la bascule : « Tant que la bascule DNS n'a pas eu lieu, # `public/_headers` sert un `X-Robots-Tag: noindex` GLOBAL qui prime sur ce # fichier : rien n'est indexé, quoi que dise robots.txt. Le retrait de cet # en-tête est une tâche de phase 6. » # # Au présent : l'en-tête global est RETIRÉ (lot 6.2), plus rien ne prime sur ce # fichier, et ce sont les 9 balises ci-dessus qui portent seules le hors-index. # ⚠ Les URL d'APERÇU de PR, elles, restent `noindex` — mais par Cloudflare, qui # l'injecte sur les URL de version, PAS par ce dépôt. Mesuré le 2026-08-10 sur # l'aperçu de la PR #192 : la route dynamique `/api/contact` y porte # `x-robots-tag` sans porter `referrer-policy` ni `x-content-type-options`, les # deux qui viennent bien de `_headers`. Ne pas croire que retirer un en-tête du # dépôt exposerait les aperçus. # # ⚠ L'hôte de ce fichier est ÉCRIT EN DUR (ligne `Sitemap:`), contrairement à # `llms.txt` dont l'hôte vient de `site` dans `astro.config.mjs` — il ne suivra # aucun changement d'hôte tout seul, et aucun script du dépôt ne le lit. C'est # l'autre moitié de D-023, qui reste ouverte. User-agent: * Allow: / Sitemap: https://www.hoodi.ai/sitemap-index.xml