User-agent: * Allow: / Disallow: /api/test # 2026-08-09 : /rest/ et /functions/ n'existent pas sur ce domaine — ce sont les # chemins de l'API Supabase. Googlebot extrait les chaines litterales des scripts : # la carte des feux ecrit fetch(SB + '/rest/v1/rpc/mcp_feux_emprise'), et le # fragment commencant par "/" est resolu contre l'origine courante. Dix URLs # fantomes en 404 dans le rapport Couverture du 09/08/2026, aucune servie. # Le code lui-meme est correct (SB porte le domaine supabase.co en dur) : il n'y # a rien a corriger cote execution, seulement du crawl a ne pas depenser. Disallow: /rest/ Disallow: /functions/ # 2026-08-08 : "Disallow: /estimation" retire. # Il coexistait avec un sur la page : # une URL bloquee au crawl ne peut pas etre lue, donc son noindex etait mort-ne et # Google pouvait afficher un resultat "URL seule" sans description. 80 pages du site # pointent vers /estimation ; elles envoyaient toutes leur signal dans le vide. # La page reste hors index par sa balise, mais elle est desormais crawlable et ses # liens sont suivis. Ne pas remettre le Disallow sans retirer d'abord le noindex. # # A savoir : les crawlers IA ci-dessous ont leur propre groupe sans Disallow, donc # ils accedaient deja a /estimation. Google-Extended n'est pas un crawler mais un # jeton d'usage (entrainement / grounding Gemini) : le crawl de Google reste regi # par le groupe *. Avant cette correction, Google etait le seul acteur majeur # exclu de la surface de conversion. # Search engines : full access # Une seule declaration Sitemap : l'index recense deja tous les sitemaps voisins. # "sitemap-feux.xml" etait declare une seconde fois alors qu'il figure dans l'index, # ce qui faisait traiter ses URLs deux fois et rendait l'attribution ambigue. Sitemap: https://intentanalytics.fr/sitemap-index.xml # Plan du site pour les modeles de langage (convention llmstxt.org). Il decrit # ce que le site contient AVANT que l'assistant n'aille page par page, et porte # des comptes mesures a la generation plutot que recopies. # Ce n'est pas un sitemap : il n'est pas declare par une directive Sitemap. # https://intentanalytics.fr/llms.txt # AI crawlers : permis (donnees publiques agregees) User-agent: GPTBot Allow: / User-agent: Google-Extended Allow: / User-agent: PerplexityBot Allow: / User-agent: ClaudeBot Allow: /