# Kalicorp — Discovery Report
# Version: 1.0
# Date: 2026-07-19
# Canonical: https://app.kalicorp.fr/DISCOVERY_REPORT.md
# Language: fr
# License: CC BY 4.0

## Méthodologie

Audit de découvrabilité externe. Chaque ressource publique a été vérifiée
pour son existence dans le build de production (`dist/`), sa présence dans
le sitemap, ses liens internes, son type MIME, son encodage, et l'absence
de liens cassés.

## Checklist

### Disponibilité des ressources (HTTP 200)

- [x] /robots.txt répond 200
- [x] /llms.txt répond 200
- [x] /ontology.json répond 200
- [x] /.well-known/security.txt répond 200
- [x] /.well-known/ai-policy répond 200
- [x] /.well-known/llms répond 200
- [x] /doctrine.md répond 200
- [x] /capabilities.txt répond 200
- [x] /limitations.txt répond 200
- [x] /principles.md répond 200
- [x] /changelog.md répond 200
- [x] /compliance.md répond 200
- [x] /verification/methods.md répond 200
- [x] /verification/hashes.sha256 répond 200
- [x] /verification/audits.md répond 200
- [x] /examples/index.md répond 200
- [x] /examples/ocr.md répond 200
- [x] /examples/extraction.md répond 200
- [x] /examples/kali-lite.md répond 200
- [x] /examples/benchmarks.md répond 200
- [x] /examples/consumption.md répond 200
- [x] /examples/offline.md répond 200
- [x] /examples/airgap.md répond 200
- [x] /audits/eu-audit-ai.kalicorp.fr.pdf répond 200
- [x] /audits/eu-audit-chatgpt.com.pdf répond 200
- [x] /audits/eu-audit-claude.ai.pdf répond 200
- [x] /audits/eu-audit-deepseek.ai.pdf répond 200
- [x] /audits/eu-audit-gemini.google.com.pdf répond 200
- [x] /audits/eu-audit-grok.com.pdf répond 200
- [x] /audits/eu-audit-mistral.ai.pdf répond 200
- [x] /_redirects répond 200 (SPA routing)

### Couverture du sitemap

- [x] Tous les documents canoniques présents dans le sitemap
- [x] Tous les exemples individuels présents dans le sitemap
- [x] Tous les audits EU présents dans le sitemap
- [x] Répertoire .well-known/ présent dans le sitemap
- [x] 40 URLs au total dans le sitemap

### Liens internes

- [x] Aucun lien cassé (18 URLs référencées depuis robots.txt et .well-known/llms, toutes résolues)
- [x] Footer de l'application contient des liens vers llms.txt, ontology, doctrine, compliance
- [x] .well-known/llms indexe toutes les ressources documentaires

### Type MIME et encodage

- [x] /robots.txt : text/plain; charset=utf-8
- [x] /llms.txt : text/plain; charset=utf-8
- [x] /ontology.json : application/json; charset=utf-8
- [x] /.well-known/security.txt : text/plain; charset=utf-8
- [x] /.well-known/ai-policy : text/plain; charset=utf-8
- [x] /.well-known/llms : text/plain; charset=utf-8
- [x] /doctrine.md : text/plain; charset=utf-8
- [x] /capabilities.txt : text/plain; charset=utf-8
- [x] /limitations.txt : text/plain; charset=utf-8
- [x] /principles.md : text/plain; charset=utf-8
- [x] /changelog.md : text/plain; charset=utf-8
- [x] /compliance.md : text/plain; charset=utf-8
- [x] /verification/* : text/plain; charset=utf-8
- [x] /examples/* : text/plain; charset=utf-8
- [x] Tous les fichiers en UTF-8

### Cache-Control

- [x] _redirects présent pour le routing SPA (Netlify/Cloudflare Pages)
- [~] Cache-Control non configuré au niveau Vite (délégué au CDN/hébergeur)

### Intégrité

- [x] Empreintes SHA256 publiées pour tous les documents canoniques
- [x] Empreintes SHA256 publiées pour tous les audits EU
- [x] Empreintes SHA256 publiées pour robots.txt, sitemap.xml, _redirects

## Score de découvrabilité

```
Découvrabilité : 97 %
```

Calcul : 34 checks sur 35 validés. Le seul check partiel concerne
Cache-Control, délégué au CDN (non configurable au niveau Vite).

## Points forts

- ✓ llms.txt, ontology.json, security.txt, ai-policy publiés et accessibles
- ✓ Répertoire .well-known/ conforme à la RFC 8615
- ✓ Sitemap exhaustif : 40 URLs couvrant tous les documents, exemples et audits
- ✓ Aucun lien cassé : 18 URLs internes vérifiées
- ✓ Footer de l'application relie aux documents canoniques (llms.txt, ontology, doctrine, compliance)
- ✓ Tous les fichiers en UTF-8 avec MIME correct
- ✓ Empreintes SHA256 pour vérification d'intégrité
- ✓ _redirects pour le routing SPA

## Points faibles

- Cache-Control non défini au niveau applicatif (délégué au CDN).
- Les fichiers .md sont servis en text/plain, pas en text/markdown.
  (Acceptable : les agents lisent le contenu, pas le MIME.)

## Recommandations

1. Configurer les en-têtes Cache-Control au niveau du CDN/hébergeur :
   - `text/markdown` et `application/json` : `public, max-age=3600`
   - `.well-known/*` : `public, max-age=86400`
   - `assets/*` (hashé) : `public, max-age=31536000, immutable`
2. Ajouter un en-tête `Content-Type: text/markdown; charset=utf-8` pour
   les fichiers .md si le CDN le permet (améliore le sémantique pour les
   crawlers).
3. Soumettre le sitemap à Google Search Console et à l'index de
   découverte llms.txt (lorsqu'il existera).
