# Edikka — politique d'exploration et d'usage des contenus # Responsable : Bertrand Morel — Edikka # Dernière revue : 2026-08-23 # Prochaine revue : 2026-09-16, puis revue trimestrielle. # # Action de gouvernance au plus tard le 2026-09-15 : vérifier dans Cloudflare # Security Settings > Configure AI bot policies la configuration distincte # des comportements Search, Agent et Training. # # Objectif : rendre les contenus publics découvrables et citables, tout en # formulant une réserve de droits expresse à l'égard de leur utilisation pour # l'entraînement ou le fine-tuning de modèles. # # Politique Edikka : # - recherche, indexation et citation : autorisées ; # - grounding, RAG et réponses générées à la demande : autorisés ; # - entraînement et fine-tuning : droits réservés ; # - réutilisation attendue : référence, extrait, attribution et lien vers la # source, sans reproduction complète. # # Signification des directives Content Signals : # - search=yes : autorise la constitution d'un index et la restitution de # résultats de recherche ; # - ai-input=yes : autorise l'usage à la volée pour le grounding, le RAG et # les réponses générées en temps réel ; # - ai-train=no : exprime une réserve lisible par machine contre # l'entraînement et le fine-tuning ; # - use=reference : demande une réutilisation limitée à la référence, à # l'extrait et au lien vers la source. # # Portée : les commentaires documentent la doctrine Edikka et sont ignorés par # les parseurs de robots.txt. Les préférences techniques sont exprimées par la # directive Content-signal et par les groupes user-agent ci-dessous. # Ces mécanismes sont déclaratifs : ils ne constituent pas un contrôle d'accès # et ne remplacent ni les protections serveur, ni les règles WAF, ni la # vérification de l'identité réelle des robots. # # Exécution hors robots.txt : # - Cloudflare : Search et Agent doivent rester autorisés ; Training doit être # bloqué après vérification des crawlers classés à usages multiples ; # - Search Console : lorsque le contrôle des fonctionnalités IA génératives est # disponible pour la propriété, conserver l'option d'inclusion activée ; # - journaux serveur : distinguer l'identité déclarée par le user-agent de # l'identité vérifiée par IP, DNS ou signature lorsqu'elle est disponible. # # Exception assumée : CCBot (Common Crawl) n'est pas bloqué. Common Crawl est # une archive ouverte dont les réutilisations en aval ne sont pas entièrement # maîtrisables. Maintenir son accès est un choix de visibilité réexaminé à # chaque revue ; ce choix ne modifie pas la préférence ai-train=no. # # Politique détaillée et protocole de vérification : # https://www.edikka.com/insights/seo/bloquer-robots-ia User-agent: * Content-signal: search=yes, ai-input=yes, ai-train=no, use=reference Disallow: /admin Allow: / # Réserve d'entraînement adressée aux contrôles spécialisés documentés. # Ces groupes ne ferment pas Google Search, les Aperçus IA, AI Mode, Gemini, # Bing, ChatGPT Search, Claude Search ou les agents distincts déclenchés par # un utilisateur. User-agent: Applebot-Extended Disallow: / User-agent: GPTBot Disallow: / User-agent: ClaudeBot Disallow: / User-agent: meta-externalagent Disallow: / User-agent: Bytespider Disallow: / # Contextes publics lisibles par les machines : # https://www.edikka.com/llms.txt # https://www.edikka.com/llms-full.txt # https://www.edikka.com/charte-edikka.md Sitemap: https://www.edikka.com/sitemap.xml